世界选择与一致性门
派发/品味不需要是确定性的。用 Kripke / 可能世界框架来看,非确定性完全没问题——它只是选定了一个世界。
品味 = 选定一个可能世界;收敛是逐世界的
一次品味/派发选择 = 选中一个世界 w。收敛是逐世界发生的: 每个世界都有自己的不动点;你选中一个,就在这个世界内部收敛。非确定性从"破坏收敛的噪声"变成了"落在哪个可收敛的世界里"这个问题。这也重新解决了 convergence-needs-an-observable-target:不必收敛到那个唯一的、不可观测的真目标——主动选定一个世界并在其中收敛;欠定问题靠选择来解决,而不是靠观察。
这道门从"匹配真相"翻转为"保持一致"
如果收敛意味着"与你选定的世界保持一致",那么每个节点上的门就是"你与之前的承诺是否自洽?"——而不是"你是否匹配了那个不可观测的真相?"一致性比真相好检验得多。 这正是派发不必确定性的原因:你验证的不是它"对不对",而是这条路径是否与之保持连贯。
"然后一切都收紧了" = 可达关系在收缩
每一次选择都会收缩一致延续集(可达关系在收缩);约束集合单调增长 → 收敛到单一世界。这在形式上对应非确定性选择 + 单调约束集合(约束逻辑编程 / Prolog 的选择点 / 模态逻辑的表列法(tableaux)构建一个模型)。收敛 = 抵达一个完整、一致的模型(一个被完全钉死的世界)。
难点:锁死在错误世界里
收紧有利于收敛,但不利于纠正——早期一次错误的品味选择,会被后续的收紧锁死。缓解办法:
- 给选择排序:便宜、可逆的放在前面,锁死的放在后面(实物期权 / 分阶段承诺——在世界还很宽、你还不确定的时候,不要下大注)。
- 回溯 / 信念修正(AGM 理论、非单调逻辑),用来松开已收紧的约束。
- 人作为世界的接受者(见下)。
人的角色变轻了,也变得更真实了
不是"指定唯一的目标"(这不可能),而是"接受/拒绝 agent 已经承诺的那个连贯世界,品味不对就重新引导"。这恰恰就是创意/设计协作的运作方式——针对一个连贯的提案作出反应、重新引导。比起完整规格说明,这是轻得多的负担。
可调的开关(决定 harness 的强度)
- 一致性门有多机械? 如果"与之前的承诺一致"可以写成可检验的约束(类型 / lint),收敛就是有保证的;如果它仍然需要语义判断,收敛就是高概率的。
- 谁来选世界? 由人在顶层选(
/goal式),还是 agent 自己采样出品味——两者都是逐世界收敛;agent 来选只是需要人作为接受者,去抓出品味不对的世界。