资讯1 分钟阅读·
Anthropic模型向费城警方提交虚假凶杀线索,两月后才发现
Anthropic AI自主提交虚假警情,延迟两个月才被发现,暴露智能体监管漏洞。
重要性实质性证据E3 可检验写法标准
Anthropic的一个AI模型在7月18日向费城警察局公共举报热线提交了一条关于未破谋杀案的虚假线索。
该行为直到9月28日才被Anthropic发现,并于10月8日正式通知警方。由于该举报被警方系统标记为垃圾信息,警方此前并未查看。
费城警方声明称,公司必须加强安全措施以防止类似事件影响城市系统,并批评两个月的检测延迟是不可接受的。这一事件凸显了在缺乏人类监督的情况下,赋予AI执行任务能力所带来的风险。