新框架提出人类主权的多智能体通信协议,预注册实验揭示AI间信息“先到先得”偏差

arXiv论文介绍Civilization Framework与Embassy Protocol,将文明而非个体代理作为寻址主体,并报告一项预注册1908次试验,发现AI收到错误信息时“先到先得”效应显著,但整体结果被注册机构判定为不确定。

AI解读:这篇论文解决的核心问题是AI系统之间直接通信时缺乏可信的上下文传递机制——人类只是AI之间的“传输层”,每经手一次信息就丢失部分语境。作者提出的Civilization Framework把人机关系重新定义为“一个人类主权者+一个持久账本+可互换的代理”,通信在文明层面发生,而不是在某个具体AI代理层面。这样设计的好处是,无论哪个代理在线处理信息,账本上的承诺状态始终是事实真相,不依赖消息是否送达。论文中最值得注意的发现是“时间权重效应”:在一项预注册的1908次试验中,当正确性验证被移除时,先到达的错误信息影响了54.2%的回答(完整验证下仅4.2%)。这对依赖多AI协作的用户是个提示:除非有明确的验证机制,否则先来的信息往往被赋予不应有的权威。不过论文自己也承认,由于工具使用检查未达到预注册的调用预算条件,这一轮实验整体被判定为“无结论”,所有结果只能视为探索性的,复现实验已在计划中。普通读者暂时不必据此改变工作方式,但开发者若考虑让多个AI代理对接,应注意先到信息的权威问题是真实存在的设计隐患,建议等待复现结果或自行增加验证层。

一篇预印本论文提出Civilization Framework和Embassy Protocol,旨在解决AI系统之间直接通信时的信任与上下文丢失问题,并报告了一项预注册实验,发现AI在接收信息时存在“时间权重效应”——先到达的错误主张会获得不应有的权威。论文作者为Guangjun Liu,于2026年9月3日提交至arXiv,编号2609.03425,共44页,4张表。

框架设计与协议机制

论文提出,人类实际上是AI系统之间的传输层,在每次信息传递中都会丢失上下文。为此,Civilization Framework将通信的寻址对象定义为“文明”而非单个代理:一个文明由一位人类主权者、一个持久账本和可互换的代理组成。

Embassy Protocol是一个与传输载体无关的覆盖层:消息以异步方式到达接收方的常驻账本端点,接收方的任意在线代理均可处理这些消息;双方账本上的承诺状态(而非消息是否送达)被视为事实依据。

代理的权限来源于其可访问的记忆:一个代理代表某文明行事的权力受其可访问记忆的限制,并通过签名凭据外部化,这与文明层面的声誉机制相分离。

预注册实验与“时间权重效应”

论文识别了一种AI间通信中的风险——“时间权重效应”:先到达的信息获得了不应有的权威。该效应在一项预注册的1908次试验中测试于一个前沿模型上。

结果显示:在移除验证的情况下,先到达的错误上游主张捕获了54.2%的回答;在完整验证下仅为4.2%。而当相同主张在接收方已封存自己的回答之后到达时,捕获率为31.6%。论文指出,两个提示外壳的长度并不匹配,因此部分差距可能反映外壳形式而非效应本身;两项注册的问题集规范均同意这两个主要结论(排除规范被预注册为统计功效不足)。

两个次要结果——指令级来源标注的缓解效应以及封存答案的准确性等价性——依赖于特定问题集规范,仅在全问题规范下成立。

注册状态与结果限制

由于一次工具使用的注册检查未满足调用预算条件,注册机构将该轮实验分类为无结论,上述所有主要和次要结果均被报告为探索性研究。论文计划进行一项使用框架强制预算的复现实验。

框架的文明内部层已有可工作的实现。

信息来源