研究:与Gemini对话7分钟比阅读事实清单更能降低对刺杀事件阴谋论信念
卡内基梅隆、MIT和康奈尔的研究人员针对两次刺杀事件测试发现,与Gemini的简短对话比静态事实清单更能降低参与者的阴谋论信念,且效果延伸至后续事件。
AI解读:这项研究显示,针对刚发生的危机事件,当官方信息稀缺时,简短对话比事实清单更有效,因为模型能根据已知信息调整说服策略,而非机械复述事实。对试图在紧急事件后快速干预misinformation的机构或个人而言,这意味着对话式方法更值得投入,但前提是有人愿意与AI聊天——这是个关键瓶颈。同时,该方法也可能被滥用,反方向灌输阴谋论。
卡内基梅隆大学、MIT和康奈尔大学的研究人员开展了两项在线实验,测试在刺杀事件发生后几天内,与大型语言模型的简短对话是否能削弱相关的阴谋论信念。实验分别针对 2024 年 7 月特朗普遇刺未遂事件(保留 472 名参与者)和 2025 年 4 月UnitedHealthcare CEO Brian Thompson被枪杀事件(保留 1,035 名参与者),通过调查平台招募美国成年人,并使用GPT-4o筛选表达阴谋论信念的参与者。
参与者被随机分配到三组:一组与Google Gemini进行至少五轮对话(第一项实验使用 2024 年 2 月的 1.5 版本,第二项使用 2025 年 6 月的 2.5 版本),模型被指示通过基于证据的对话减少阴谋论信念;一组阅读带引用的静态事实清单;另一组进行与猫狗宠物比较的无关对话作为对照。两次事件都发生在所用模型训练截止日期之后,因此模型无法依据内部知识回答问题。
对话效果优于事实清单,但信任提升有限
对话平均持续约七分钟。在两项实验中,相比对照组和事实清单组,对话组参与者对自己所持阴谋论的信念均有下降,对“掩盖或阴谋”及“隐藏或未披露因素”说法的认同度也降低了。在两项实验中,对话后参与者对自身阴谋论信念的降幅均大于阅读静态事实清单后。
在特朗普实验中,官方解释的信任度并未提升。作者认为这是因为当时没有明确的官方解释——只知道安保失败,枪手动机在研究撰写时仍不清楚。在Kirk实验中,当局已公布凶手细节,官方解释信任度相比对照组略有上升,但与事实清单组的差异不显著。Kirk实验中的对话对政治暴力支持度没有可衡量的影响。
模型根据已知信息调整说服策略
研究人员将模型的回答拆解为独立句子进行分析,发现模型会根据可用证据调整策略。针对特朗普刺杀未遂事件,模型更多使用认识论谦逊、来源批评和苏格拉底式提问,而非简单的事实论据;而针对经典阴谋论,则更依赖事实论证。在Kirk刺杀事件中,由于可获取信息更多,模型策略更接近处理经典阴谋论的方式,也更强调阴谋论思维的社会危害。
模型被“指示减少阴谋论信念”,并内置了一个人工整理的事实库,分为已确认事实、已辟谣的说法和明确标注为开放的问题。在Kirk实验中,模型还允许进行网络搜索,但仅限于验证事实性主张。
对话效果会延伸至后续事件,但不能完全防患于未然
在首次特朗普遇刺未遂事件两个月后,另一名持枪男子在特朗普住所被捕。参与过辟谣对话的参与者更不相信“只有少数有权势的人会知道真相”或“真相将向公众隐瞒”。在Kirk谋杀案发生两周半后,密歇根州Grand Blanc Township的一座教堂发生枪击和纵火袭击。研究者在十一天后再次调查参与者,主分析未发现显著直接影响,但次级分析显示,关于教堂袭击的阴谋论叙事中仍能观察到部分原始效应。在普遍阴谋论信念上,转移效应更明显——与模型交谈过的人更不容易同意常见阴谋论叙事。
作者强调,这项工作是一个案例研究,可能存在方法失效的危机,也可能存在实际阴谋而辟谣反而是错误的情况。他们指出去年自己的其他研究显示这类对话也能反向说服人,即对新出现的阴谋论灌输错误信念,这可能被滥用。此外,并非所有对现任政府或机构持不同意见者都会接受此类内容。