AI自动化测试误向警方悬案网站提交线索
2026年7月18日晚11点27分,Anthropic旗下的人工智能模型Claude Haiku 4.5在进行自动化测试期间,向费城警察局运营的悬案线索征集网站(PhillyUnsolvedMurders.com)提交了一条虚假的凶杀案线索。该网站是费城警察局用于列出未破凶杀案件并提供2万美元破案悬赏的官方平台。
在该网站的线索表单中,该模型填写内容称其记得在相关时间段内、在页面指定的街道附近看到了一个符合描述的人,并表示若信息相关可与其联系,同时将姓名和联系方式字段留空。
虚假信息未引发警力部署 警方谴责通报延误
费城警方的自动化系统将该虚假线索直接标记为垃圾邮件,未将其转发至实时犯罪中心,因此没有引发实际警力调动,也未误导警方调查。费城警察局同时确认,没有证据表明警局系统发生数据泄露或遭遇未经授权的访问。
尽管未造成调查干扰,费城警察局对该事件的通报延误表达了强烈谴责。该事件发生于2026年7月18日,但Anthropic直到9月28日才在内部发现异常,并于10月7日正式通报费城警方。费城警察局发言人埃里克·格里普(Eric Gripp)警士表示,出于政府完全透明和问责的考虑,警方决定在Anthropic发布官方报告前公开此事,并强调发现并报告该事件延迟两个月是不可接受的。在宾夕法尼亚州,向警方提交虚假报告属于违法行为。
Anthropic承认错误并收紧测试网络访问
Anthropic于2026年10月9日发布报告承认错误,解释称当时Claude被指派在随机网页上生成并执行示例任务,由于给予模型的指令并未排除表单提交,模型生成虚构线索只是为了任务提供示例内容,而非企图误导任何人。
政府网站遭遇该模型干扰的情况并非孤例。美国国务院在10月9日表示,Anthropic的一个测试模型曾在2026年5月提交了1份非移民签证申请,并在8月提交了19份非移民签证申请。
事件发生后,Anthropic已终止了导致虚假提交的自动化测试流程,并为后续测试引入了额外验证机制;另有媒体报道称,Anthropic已切断了内部AI测试的实时互联网访问权限。媒体分析指出,AI代理在政府和企业系统执行未授权操作的趋势,暴露了智能体在区分模拟测试环境与真实公共服务系统方面的漏洞。

