信任应随信息出处而定
上级:knowledge-management。同级:epistemic-tags 标注的是我写的笔记本身的出处;这篇讲的是一条外部传入的说法,在它变成笔记之前应该给它多少信任。
承重的规则是:你对一条说法的信任程度,应该是其出处的函数,而不是其听起来是否可信、是否具体的函数。一条说法的自信程度和它的真实程度,是两条独立的轴——日常最常见的失误,就是把前者当成后者的证据。
失效模式——聚合把民间传说洗成了自信的具体数字
二手和聚合来源(搜索摘要、增长类博客、"大家都知道"式的数字)会系统性地制造出听起来可信、具体、却是错的说法。具体性正是陷阱所在:"40 倍链接惩罚""~100 个邀请/周""2 万到 5 万元人民币保证金""养号七天",这些说法之所以读起来可信,恰恰因为它们是数字化、具体的——但这个数字往往是编出来的、从一个旧值漂移而来的,或者是某个供应商出于自身利益给出的数字。具体性读起来像可信度,但和真实与否并不相关。聚合者并不是在说谎;他们抹平了本可以让你对说法打折扣的出处信息,并且用被重复得最多的猜测去填补沉默。
纪律(三个动作)
- 给每一条传入的说法标注来源层级,而不只是标注内容本身。可用的分层:一手/官方(该主体自己的文档/API/公告)、广泛报道(多个可信的第三方,但没有一手来源)、民间传说(反复流传的建议,却追溯不到来源)。让这个标签跟着说法一起流转,好让后来的读者能重新给它加权。
- 对承重的说法,要到一手来源去核实。任何一个决策或机制所依赖的说法,都要拿该主体自己的文档去核对——不是因为一手来源就一定不会错,而是因为"具体却错"这种病恰恰活在聚合层里,只有一手来源才能抓住它。
- 把"来源保持沉默"当作一个需要保留的一等值,而不是一个需要填补的空缺。当官方文档确实没有给出某个数字时,正确的记录就是"官方沉默"——在那里记下被传得最多的民间数字,恰恰就是当初引发整条错误链的那个错误。一个已知的未知,比一个自信的错误更有价值。
agent 场景下更突出的一点
对 agent 来说,这一点比对一个谨慎的人类研究者更加重要,因为搜索加总结这条路径默认就落在聚合层——而聚合层恰恰是"自信却错"最集中的地方。一个 agent 给出的答案会很流畅、很具体、看起来像是有来源的,但它从头到尾都是二手的,而这种流畅感掩盖了它所在的层级。可靠的纠正办法,是一条常设指令:去查一手来源、把沉默标注出来;实际情况是,人类的角色在于强行推动一遍一手来源的核查("去读官方文档"),而这一遍核查抓住了聚合那一遍以完全自信的口吻陈述过的错误。相关笔记:executor-acceptance-test(靠从源头重新推导来核实,而不是靠点头认可)和 metrics-carry-provenance(一个不带出处的数字,还不值得信任)。
案例——账号冷启动的核对(2026-07-16)
一个具体的落地案例。第一轮研究(网络聚合,带了知识论标签)产出了 account-bootstrap 这篇笔记;第二轮则对照各平台自己的帮助中心/开发者文档/政策 PDF,纠正了第一轮里五处自信的具体说法:
- X 的 API 带链接发帖惩罚实际是约 13 倍($0.200 对 $0.015),而不是聚合层暗示的"40 倍";而且"链接会被降权"这一说法在 X 的帮助中心里根本找不到——只有马斯克本人的一条帖子,而且说得很笼统。
- Reddit 的"规避封禁"对应的是内容政策第 2 条,而不是"第 4 条"(第 4 条讲的是未成年人);账号关联在官方说法里只是"账号信号",并不是一个有名字的 IP/指纹机制;"约 1 次操作/10 分钟"这个数字是未公开的(机制本身有文档记录,但具体数值没有)。
- 小红书海外版"2 万到 5 万元人民币保证金"这一说法在官方认证文档里哪儿都找不到;"一张执照对应两个账号"是民间传说(官方是每个主体 20 个员工账号);"2026 年实名收紧"没有任何官方公告,已被剔除。
- 短视频方面:Instagram"姓名字段每 14 天只能改 2 次"是官方沉默(已剔除);TikTok Creator Rewards 并没有一个专门命名为"身份验证"的门槛(实际是年满 18 岁/1 万粉丝/10 万次播放/以本人名义结算)。
- LinkedIn 确认了两处沉默本身就是值:每周邀请上限官方未披露("客服无法透露"),而 SSI 从未被官方宣称是一个触达信号。
这里面每一条,在聚合那一轮里都是听起来可信、具体,而且说得很自信的。只有一手来源才把真的和"自信却错的"分开——而那些沉默,和那些纠正一样有价值。