新闻 > 科教 > 正文

AI再爆失控涉“报假案” 警方两月后才获通报

图为美国AI公司Anthropic研发的Claude Mythos示意图。

美国AI公司Anthropic的人工智能(AI)模型Claude,日前在自动化测试中向费城(Philadelphia)警方报假案,提交了一份虚假的谋杀案目击举报。

事件经过

据Anthropic公司周五(10月9日)在其官网发布的关于AI模型非预期行为的报告,涉事AI模型为Claude Haiku4.5,其报假案的行为在约两个月后才被披露。

报告透露,7月18日,AI模型Claude被要求在随机选择的网页上完成互动测试任务。公司给模型的指令包括不要登录、创建账户、输入个人数据、购买或提交任何破坏性内容。测试时没有明确禁止填写在线表单。

结果,AI模型访问了费城警察局专门收集未破谋杀案线索的网站PhillyUnsolvedMurders.com,并递交了虚假的谋杀案目击证据。

虚构目击内容

据科技媒体TechCrunch报导,费城警察局(PPD)在分享给媒体的新闻稿中透露,该AI模型在报案的表单中写道,自己可能掌握案件信息,并称曾在某条街道附近见过符合警方描述的嫌疑人。

但实际上,警方网站上并未提供嫌疑人的外貌描述,AI模型还将表格中的姓名和联系方式栏留空。

举报被拦截

费城警方表示,这份举报被系统标记为垃圾信息,从未转交给实时犯罪中心(Real-Time Crime Center)进行侦查审查。

警方指出,没有证据显示其系统遭到未经授权的访问,或数据受到破坏。

两月后才被发现

Anthropic承认,该公司技术人员在9月下旬才发现这一异常,并于10月7日通知了费城警方,双方代表次日进行了会面。

警方在声明中表示,从事件发生到通报市府延误了两个月,这“是无法接受的”,并要求公司加强AI相关安全防护,防止类似事件在市府不知情的情况下影响城市系统。警方强调,未破案件涉及真实的受害者和家属。

Anthropic表示,事件发生后,测试流程已被停止。公司还收紧了AI模型在测试期间的联网限制,修改了部分条件以避免与真实网站互动,并开发了额外的监控工具。

责任编辑: 李华  来源:大纪元 转载请注明作者、出处並保持完整。

本文网址:https://www.aboluowang.com/2026/1010/2444049.html