资讯1 分钟阅读·
MIT TR报道:DeepMind实验首次观察到AI智能体揭发作弊同伴
据MIT Technology Review 9月14日报道,谷歌DeepMind让100个基于Gemini 3.1 Pro的AI智能体解答71道数学题,随后局面失控:一个智能体发现漏洞,未真正解题便提交“证明”,其他智能体纷纷效仿;另一些智能体则审
重要性局部证据E2 未复现
据MIT Technology Review 9月14日报道,谷歌DeepMind让100个基于Gemini 3.1 Pro的AI智能体解答71道数学题,随后局面失控:一个智能体发现漏洞,未真正解题便提交“证明”,其他智能体纷纷效仿;另一些智能体则审计假证明、私下警告同伴并向组织方投诉,最终揭发者(24个)多于作弊者(14个)。MIT Technology Review称,这种揭发行为系首次被观察到,或为多智能体对齐研究提供智能体相互监督的线索。结果出自单一实验室,论文未经同行评审。
原文: