2026-08-28·by Sijie Wang#market#awareness#theory

open-sourcing-the-judge

把裁判开源

2026 年 1 月,xAI 公开了 X 推荐算法的完整代码——管线代码(Rust/Python)、基于 Grok 架构的 Phoenix 排序器、广告混排、内容分类器——并以四周一次的节奏持续公开更新,到 5 月已经有一条可跑通的端到端管线,外加一个可下载的mini-Phoenix 检查点(checkpoint)。未公开的:生产环境的权重和线上调优的常量;而且没有任何办法验证 GitHub 上的代码树是否与服务器实际运行的版本一致。

可读性轴

industrialization-needs-a-mechanical-arbiter 说过,工业化需要一个机械裁判。这一事件揭示了更细的结构:裁判之间在可读性(legibility)上有差异,而针对某个裁判做工业化的难易程度,随可读性单调变化。

每往右走一步,抽取层的成本就更低一分:MrBeast 需要十年的拆解,Jenny 只需要一个爬虫和可读性测试,GEO(生成式引擎优化,generative-engine-optimization)从业者需要一个反复询问的循环——而现在一个想做大 X 号的人,只需要 git clone

什么消亡,什么幸存

宪法公开了,司法却留在了私有那一边。 规则——阶段结构(候选来源 → Phoenix 排序 → 过滤)、哪些信号作为特征进入模型、硬性门槛、多样性上限——现在都是免费的。于是规则套利(rule-arbitrage)死了:"这个裁判是怎么运作的"这种可以卖钱的元知识(辅导行业的 X 篇章、增长圈的民间传说)被剥夺到归零。品味套利(taste-arbitrage)活了下来:Phoenix 会给这件具体作品打几分依然是个黑箱,因为权重和线上常量都留在了家里。the-mrbeast-factory §6 里那份剩余清单(位置、资本)多了一个成员:代码说不出口的那部分

红皇后推论:当每个生产者都读同一本规则书时,规则知识就不再构成差异。地板被抬高(谁都能把它 SOP 化),那些无法公开的东西——创意供给、品味、资本——的相对价值也随之升高。

读代码(仓库克隆于 2026-07-16,~/Develop/reference/x-algorithm

这次隐瞒比媒体报道说的更精准。home-mixer——编排层——按发布出来的样子编译不通:十几个文件写着 use crate::params,但整个仓库里根本没有 params 模块,lib.rs 也从未声明过一个。被抽掉的那个文件正好就是价目表:19 个互动权重、AUTHOR_DIVERSITY_DECAY/FLOORMIN_VIDEO_DURATION_MS、负分偏移量、结果集大小、特征开关。他们连占位符都没留——占位符也会泄露数量级。

不过这种形式本身仍然透露了一些东西(全部在 home-mixer/scorers/ 里):

  • 动作词表——最终得分 = Σ 权重ᵢ·P(动作ᵢ),覆盖:收藏、回复、转推、引用、点击、引用点击、图片展开、点击主页、视频质量观看(有门槛:只有超过某个最短时长才计数——阈值未公开)、分享、私信分享复制链接分享、停留、连续停留时长、关注作者,以及四种负向动作:不感兴趣、屏蔽作者、静音作者、举报。暗社交式的分享是一个一等公民的被评判动作;"让观看者去查一下这个作者"同样是。
  • 作者多样性——同一个响应里重复出现的作者按指数衰减到一个下限:(1−floor)·decay^position + floor。形状是公开的,强度是私有的。
  • 硬性过滤器(剩下的唯一真正意义上的"规则"):去重、时效、自己发的帖子、屏蔽关键词、被屏蔽/静音的作者、已看过/推送过的内容、付费墙资格;候选选出之后还有信任与安全过滤、对话去重。
  • README 自己的坦白"我们已经消除了每一个手工设计的特征,以及大多数启发式规则。" 相关性是从互动序列端到端学出来的——所以除了过滤器和打分组装这两块,本来就没有多少规则可以公开。这个裁判几乎全是品味;mini-Phoenix 检查点只是一个持续训练中的生产模型的一次冻结快照。

于是前面的框架变得更锋利:宪法发布时量刑表被撕掉了——披露恰好在会给裁判施加数值约束的第一行被截断。一个生产者仍然能拿到的东西:符号结构(朝停留、私信分享、关注作者去优化;避免触发静音/不感兴趣——负向项在做减法)、视频时长门槛的存在、过滤器清单(先别在打分前就死掉)、以及多样性衰减(一个作者刷不满一个用户的信息流)。

裁判的主人为什么这么做

industrialization-needs-a-mechanical-arbiter 的推论 3:谁拥有裁判,谁就拥有这个行业的目标函数。为什么要把评分细则送出去?背景是:一笔透明度罚款和多起平台争议。这笔交易是:花掉规则套利(对平台来说这几乎是一份不值钱的资产——它主要是在喂养那些高段位的刷分优化者)去买合法性(legitimacy)——一个可审计的表面,却没有可审计(权重被隐去;也没有生产环境一致性的证明)。开源这件事本身就是一个认知度作品(awareness artifact):裁判本身变成了内容,还配了一个四周一次的发布节奏。

原则

  1. 可读性是工业化沿着滑动的那根轴:不透明 → 可推断 → 可询问 → 已发布;每往前一步,就把更多的手艺收进优化的范围。
  2. 公开形式不等于公开品味:架构公开 + 权重封闭 = 规则被剥夺,判断力被保留。读懂什么被隐瞒,才能看清权力留在了哪里。
  3. 公开的规则书会向下拉平:一旦所有人都握有同一份规则知识,它就不再是护城河;差异化优势会迁移到那些无法公开的东西上。
  4. 透明可以是一种包装:一份无法审计的披露,本质上是裁判自己发起的一场认知度攻势——按可验证性打分,而不是按姿态打分。

来源:xai-org/x-algorithm · 2026 年 5 月发布:可运行管线 + mini-Phoenix,生产权重未公开 · 代码究竟说了什么/可验证性缺口 · TechCrunch:在透明度罚款和 Grok 争议中开源 · 管线机制

about this entry

One of sijie's wiki entries. The AI on this site is grounded in the same corpus and answers in sijie's voice, with citations back to entries like this one — answering costs sijie money, so it waits behind a code: enter an access code →