从 SOP 到运营
专栏现在已经积累了五份不同战场的 SOP——但没有一份告诉你周一早上具体做什么。标准流程和一台真正运转的运营机器之间的落差,本身是有结构的:一共五层,每一层各有各的填法。
1. 绑定层(一个决策,不是一项研究)
这台运营机器的目标形态是一张矩阵——项目 × 战场,作为一个整体的方格网运行(账号矩阵是行业里的标准做法,不是什么发明;MCN 干的就是这个)。矩阵里的每一个格子都是一个已绑定的元组——项目 × 战场 × 形式 × 节奏——一份 SOP 执行一个格子。真正保持单一的不是这台机器本身,而是所有者的实时注意力:一次只专注一个格子(见 §4b);由 AI 驱动的探针格子填满网格里其余那些评判尺度能容忍机器介入的位置。在格子被绑定之前,每一份 SOP 都只是假设。绑定是所有者的决策;研究能提供的是决策所需的表格——下面的人力成本表,以及这里的匹配表(它正是矩阵的地图:每一个行列交叉点都是一个候选格子)。
匹配表(受众=买家,依据 x-account-sop 第一步与 when-the-playbook-sells-products 原则二;表中条目遵循各战场文件里记录的受众):
| 项目 | 买家 | 适配战场 | 不适配 |
|---|---|---|---|
| FlexMesh | 零工快递员(加拿大,含华人) | 短视频(扫码演示——cal-ai-the-screen-is-the-ad 那种形态)、小红书(司机这个细分几乎是空白)、Reddit(r/couriersofreddit 这个量级) | LinkedIn(快递员根本不在那里) |
| StandMeet | 有社交网络的思考者/建造者/以及招募他们的人 | Reddit(经过深思熟虑的工具背书 + 回答引擎的素材来源)、X(建造者密度高) | 短视频(消费方式不对) |
| YouTeacher | 面向学校/招聘方的 B2B 买家 | LinkedIn(买家就坐在信息流里) | 小红书这类消费者赛道 |
| Lucerna | 语言学习者(中文) | 小红书(教育垂类能变现——xiaohongshu-open-niches)、短视频 | Reddit(中文学习者存在感稀薄) |
共振标准(在验收测试暴露出它的缺失之后补上的):除了受众匹配和人力成本之外,优先选择那种运作机制本身就在演示产品自身论点的战场——这是 tibo-the-reflexive-pickaxe 原则一(当众挥动镐头来卖镐头)的推广版本。StandMeet × Reddit 就是现成的例子:这个战场"回答引擎素材来源"的属性,本身就是产品"解读经济"论点的实时运行;每一件作品同时也是证据。
每周工时规则(这里和文献里都不存在一个汇总公式;诚实的做法是产能优先):先从真实的日历产能里定出每周工时上限,再只接纳那些有据可查的最低工时门槛能落在这个上限之内的 SOP 组件(各项门槛见下面的人力成本表)。这颠倒了那个自然而然的诱惑(先选好野心,再发现时间根本不够),也和下文单渠道原则的分配方式一致:在一处投入深度,其余处投入为零。
2. 阵地与关键词层(研究,可以立刻填)
"找到对的 subreddit"和"建立查询词列表"这两个步骤,本身就点名了自己的缺口:具体的阵地清单和关键词库并不存在,除非有人为某个具体产品把它们组装出来。这是 agent 该干的活,每个项目×战场做一次即可。(第一次填充:FlexMesh × 小红书——flexmesh/growth/xiaohongshu-channel-kit。)
3. 库存层(10:1 的弹药)
每一份 SOP 都要求选题库存比实际产出大一个数量级。种子库存通常早就在那儿躺着——对 FlexMesh 来说,Search Console 里排名前 25 的查询词,本身就是一份受众在问什么的排序清单。所谓库存,是一个带筛选列的文件,不是一种感觉。
4. 工具层(SOP 步骤变成工具)
对一个强项是机械化的运营者来说,一个手动的 SOP 步骤就是一件还没造出来的工具。每个战场都需要的三件工具:
- 选题库存——每个项目一个文件:标题形态的选题、来源、目标查询词、状态(1000→10 的筛选总得有个地方发生);
- 单条作品日志——日期、战场、本次测试的形式变量、该战场的核心指标("每件作品一个实验"这条纪律,只有在某处预先登记过才算真的存在);
- 爆款抓取器——按战场:定期拉取该细分领域的头部作品,提取共性规律(把 Jenny 的方法做成一个定时任务;在 X 上它甚至可以读取评判者自己仓库的 diff)。
4b. 排序层(并行探针,单点专注)
这里采用的是经过检验的 Bullseye 方法(Weinberg & Mares,《Traction》)——之所以要精确表述,是因为压缩版的说法误导了第一次验收测试的执行:内圈测试阶段是低成本地并行跑多个渠道;"专注一个"这条原则适用于放大阶段,也就是在某个占优渠道显现出来之后才生效,并且要一直保持到饱和或成本上升为止。专栏里的案例证实,触发专注的从来是可测量的平台期,绝不是日历上的某个日期:Cal AI 的自然流量在转向付费之前封顶在约 $2M/月(cal-ai-the-screen-is-the-ad);Tibo 成熟期的获客里约 70% 来自非受众流量(tibo-the-reflexive-pickaxe);FlexMesh 自己的搜索渠道则在约每天 1.1k 次曝光处走平。
AI 自动化修正条款(所有者本人的修正,2026-07-16)。 这套矩阵的经济账建立在一个前提上:agent 循环就是生产线(一个驱动真实浏览器、使用真实账号的 agent 循环——Claude Code 加 Playwright 这一类工具;每个主流平台都存在这种形态的社区技能包)。没有这个循环,"生产是免费的"这句话就是假的,整个探针层就会退回到经典 Bullseye。有了它:
- 探针层——第一天就启动每一个复利计时器。 拥有复利资产的战场从第一天起就以最低节奏运行,由 agent 生产、所有者审核。信号出现所需时间长,恰恰是支持早启动而不是延后的理由:日历时间事后无法压缩。
- 每个格子原生生产,绝不套用改编。 每个格子的 agent 执行的是它自己那个战场的 SOP——验收测试已经证明 agent 可以原生地照做一份。"一稿通投所有渠道"这种失败模式(Jenny 的 TikTok 100 万播放对 YouTube 1000 播放的教训,jenny-hoyos-craft-is-scrapeable)是简单粗暴的跨平台搬运流水线才有的属性,这套架构从结构上就把它排除在外。
- 诚实地重述"禁止自动化"——评判看的是输出流,不是背后的手。 Reddit 坟场里真正的死因是超出人类可信速度的更新频率、通用套话文本、以及推广密度(reddit-industrialize-and-die)——这些都是看得见的统计特征,而不是自动化本身;能真正识别出"真实浏览器+真实账号+逐帖独特回答,且节奏符合人类习惯"这一组合的平台并不多。所以每个战场的约束是一个三元组:(速度上限、质量门槛、押上的账号资本)——把更新流控制在人类可信的速率之内、通过人类陪审团式的质量判断,并明白账号本身就是赌注(Reddit 的服务条款禁止未公开的自动化;一旦模式被识破,账号连同其积累的 karma 资本都会归零)。所以在人类陪审团式的战场里,无论由谁生产,吞吐量都得维持在人类应有的形状——循环在这里买到的是稿件质量和一致性,而不是数量。
- 稀缺账本被重写,而不是被清空:绑定性的输入变成了所有者的审核带宽(每件作品都要过品味关——未经审核的 agent 产出会腐坏,这是"机械化约束定律"在内容上的版本)、选题供给、以及实验循环所需的注意力(N 个格子=每周 N 次单变量审核)。真正承重却还没造出来的组件有两个,而且顺序很关键:上下文包(每件作品的输入组装——反套话的主控手段,slop-is-a-context-deficit;它的构成和刷新节奏不是设计出来的,而是从 SOP 自身的数据流里推导出来的,context-derives-from-the-sop)以及内容检查器(机械化的输出关卡:格式规则、红线、来源标注、单变量标签),作为进入审核队列前的最后一道后备防线。
修正后的规则:所有格子第一天起就以最低节奏铺设探针,服从(速度、质量、资本)三元约束;专注一次只给一个格子,只有在可测量的平台期出现时才转移。
4c. 发布前层(在有数字之前发什么)
各份 SOP 里那些依赖来源标注的体裁(营收计数器、透明化帖子——metrics-carry-provenance)默认已经有数字可用,而产品发布前恰恰没有这些数字。以下是案例文件本身记录下来的"没有指标之前"的做法清单:
- 先建受众,后建产品:在 RB2B 存在之前,Robinson 已经近乎每天发帖坚持了两年,积累了 4000 万次曝光(adam-robinson-radical-transparency);Butcher 在产品营收为零的情况下坚持了 11 个月的每日练习(jack-butcher-the-format-factory)。
- 一个公开的、有日期的、可证伪的目标不需要营收:Levels 的"12 个月做 12 个创业项目",在还没有任何可数之物时就已经是一个计数器了(when-the-playbook-sells-products;airrack-the-collab-ladder 原则三)。
- 过程本身也是一种来源证明:发布前唯一可验证的东西就是工作本身——提交记录、设计、实验、失败。计数器的货币从美元换成了带日期的作品;但纪律本身(可验证、有日期、包含失败)没有变。
- 漏斗之前的度量:有记录的发布前运营者追踪的是受众积累(关注者、曝光量、名单注册)——漏斗式的量表(点击→试用→付费)是在发布时才接上的,不是在此之前。
5. 点火层(第 0–30 天不是稳态)
SOP 描述的是已经在运转的机器。冷启动对每个战场来说都是自己的一份清单:账号创建的选择(个人号还是企业号,xiaohongshu-redlines)、把资料页当作落地页来经营(每个战场的"关注"决策都发生在那里)、前 10 件作品要按学习速度而不是触达量来选,以及在第一次发布之前就接好度量装置(品牌词搜索追踪、referrer 打标)——否则实验循环就是盲跑的。机械性的第 0 天清单——账号名/身份锁定、账号路径的选择、凭证卫生,以及对"账号养号"这个说法的证伪——详见 account-bootstrap。
人力成本表(源自案例文件)
| 战场 | 有据可查的最低门槛 | 有据可查的极端值 | 边际成本形状 | 首次出现信号所需时间(有据可查) |
|---|---|---|---|---|
| 每天 20 分钟(gummysearch-reply-not-post) | — | 平坦;受"禁止自动化"规则封顶 | 数周——45 天内获得 60 个客户(reddit-conversion-receipts) | |
| 小红书 | 批量写作,约每周 2–3 篇笔记 | — | 低;笔记通过搜索复利累积 | 数周至数月;搜索长尾在 6–12 个月内回报(xiaohongshu-search-is-the-moat) |
| X | 每天一条 5 句以内的洞察(nikita-bier-sell-the-spike) | 每年 700 条(Welsh) | 与发帖数量线性相关 | 约 6 个月——最低门槛公式自带的时间尺度(Bier) |
| 发布前后约 30 分钟 | 每天 4–5 小时(lara-acosta-outwork-the-feed) | 与互动时长线性相关 | 数月至数年——Robinson 在产品出现前发了 2 年(adam-robinson-radical-transparency) | |
| 短视频 | 从已有素材中拆条 | 每天 80–100 条(okamoto-the-cadence-extremum) | 固定成本(制作)高,除非产品本身就在生产素材(cal-ai-the-screen-is-the-ad) | 按单件计——零粉丝账号第一天就可能命中 |
综合规则,从表格里的两个成本列推导而来(不是从战场名字推导而来):单人运营者的第一个战场,应该是工时门槛落在预算之内、且首次信号所需时间落在决策周期之内的那一个——同样是便宜的几分钟投入,六个月才见信号(X 的门槛)和 45 天就能拿到回执(Reddit)是完全不同的两笔赌注。线性成本或高成本的战场,只有在存在能摊销的形式(固定语法、拆条)或产品本身就在生产内容素材时才值得进入。(此处措辞已于 2026-07-16 修正:此前验收测试的执行者被规则原本的措辞——它预先点名了具体战场——牵着走,而不是被表格里的数据牵着走;缺失的变量正是"首次信号所需时间"。)