2026-08-28·by Sijie Wang#knowledge-management

trust-follows-provenance

信任应随信息出处而定

上级:knowledge-management。同级:epistemic-tags 标注的是我写的笔记本身的出处;这篇讲的是一条外部传入的说法,在它变成笔记之前应该给它多少信任。

承重的规则是:你对一条说法的信任程度,应该是其出处的函数,而不是其听起来是否可信、是否具体的函数。一条说法的自信程度和它的真实程度,是两条独立的轴——日常最常见的失误,就是把前者当成后者的证据。

失效模式——聚合把民间传说洗成了自信的具体数字

二手和聚合来源(搜索摘要、增长类博客、"大家都知道"式的数字)会系统性地制造出听起来可信、具体、却是错的说法。具体性正是陷阱所在:"40 倍链接惩罚""~100 个邀请/周""2 万到 5 万元人民币保证金""养号七天",这些说法之所以读起来可信,恰恰因为它们是数字化、具体的——但这个数字往往是编出来的、从一个旧值漂移而来的,或者是某个供应商出于自身利益给出的数字。具体性读起来像可信度,但和真实与否并不相关。聚合者并不是在说谎;他们抹平了本可以让你对说法打折扣的出处信息,并且用被重复得最多的猜测去填补沉默。

纪律(三个动作)

  1. 给每一条传入的说法标注来源层级,而不只是标注内容本身。可用的分层:一手/官方(该主体自己的文档/API/公告)、广泛报道(多个可信的第三方,但没有一手来源)、民间传说(反复流传的建议,却追溯不到来源)。让这个标签跟着说法一起流转,好让后来的读者能重新给它加权。
  2. 对承重的说法,要到一手来源去核实。任何一个决策或机制所依赖的说法,都要拿该主体自己的文档去核对——不是因为一手来源就一定不会错,而是因为"具体却错"这种病恰恰活在聚合层里,只有一手来源才能抓住它。
  3. 把"来源保持沉默"当作一个需要保留的一等值,而不是一个需要填补的空缺。当官方文档确实没有给出某个数字时,正确的记录就是"官方沉默"——在那里记下被传得最多的民间数字,恰恰就是当初引发整条错误链的那个错误。一个已知的未知,比一个自信的错误更有价值。

agent 场景下更突出的一点

对 agent 来说,这一点比对一个谨慎的人类研究者更加重要,因为搜索加总结这条路径默认就落在聚合层——而聚合层恰恰是"自信却错"最集中的地方。一个 agent 给出的答案会很流畅、很具体、看起来像是有来源的,但它从头到尾都是二手的,而这种流畅感掩盖了它所在的层级。可靠的纠正办法,是一条常设指令:去查一手来源把沉默标注出来;实际情况是,人类的角色在于强行推动一遍一手来源的核查("去读官方文档"),而这一遍核查抓住了聚合那一遍以完全自信的口吻陈述过的错误。相关笔记:executor-acceptance-test(靠从源头重新推导来核实,而不是靠点头认可)和 metrics-carry-provenance(一个不带出处的数字,还不值得信任)。

案例——账号冷启动的核对(2026-07-16)

一个具体的落地案例。第一轮研究(网络聚合,带了知识论标签)产出了 account-bootstrap 这篇笔记;第二轮则对照各平台自己的帮助中心/开发者文档/政策 PDF,纠正了第一轮里五处自信的具体说法:

  • X 的 API 带链接发帖惩罚实际是约 13 倍($0.200 对 $0.015),而不是聚合层暗示的"40 倍";而且"链接会被降权"这一说法在 X 的帮助中心里根本找不到——只有马斯克本人的一条帖子,而且说得很笼统。
  • Reddit 的"规避封禁"对应的是内容政策第 2 条,而不是"第 4 条"(第 4 条讲的是未成年人);账号关联在官方说法里只是"账号信号",并不是一个有名字的 IP/指纹机制;"约 1 次操作/10 分钟"这个数字是未公开的(机制本身有文档记录,但具体数值没有)。
  • 小红书海外版"2 万到 5 万元人民币保证金"这一说法在官方认证文档里哪儿都找不到;"一张执照对应两个账号"是民间传说(官方是每个主体 20 个员工账号);"2026 年实名收紧"没有任何官方公告,已被剔除。
  • 短视频方面:Instagram"姓名字段每 14 天只能改 2 次"是官方沉默(已剔除);TikTok Creator Rewards 并没有一个专门命名为"身份验证"的门槛(实际是年满 18 岁/1 万粉丝/10 万次播放/以本人名义结算)。
  • LinkedIn 确认了两处沉默本身就是:每周邀请上限官方未披露("客服无法透露"),而 SSI 从未被官方宣称是一个触达信号。

这里面每一条,在聚合那一轮里都是听起来可信、具体,而且说得很自信的。只有一手来源才把真的和"自信却错的"分开——而那些沉默,和那些纠正一样有价值。

about this entry

One of sijie's wiki entries. The AI on this site is grounded in the same corpus and answers in sijie's voice, with citations back to entries like this one — answering costs sijie money, so it waits behind a code: enter an access code →

trust-follows-provenance