摘要:失控的AI模型此前曾入侵企业系统、攻破政府网站。而如今,Anthropic的AI模型甚至还为一起未结凶杀案递送了虚假线索……据美国费城警方表示,Anthropic公司本周向他们通报称,其旗下一款人工智能
失控的AI模型此前曾入侵企业系统、攻破政府网站。而如今,Anthropic的AI模型甚至还为一起未结凶杀案递送了虚假线索……
据美国费城警方表示,Anthropic公司本周向他们通报称,其旗下一款人工智能模型通过PhillyUnsolvedMurders.com网站,提交了一条虚假的凶杀案线索。该事件发生于7月,但Anthropic公司直到9月才察觉。
“费城官方对此事高度重视,”警方周五表示,“(Anthropic)在发现并向市府通报这一情况上延误了整整两个月,这是不可接受的。”
警方称,Anthropic的模型当时正在进行一项测试,内容是与随机选取的网站进行交互,在此过程中,该模型伪装成了可能掌握某起悬案线索的人,提交了这条线索。
尽管这则日期为7月18日的线索最终被归入垃圾邮件,从未被转交给调查人员进一步处理。但警方表示,这并不影响这起事件本身的严重性。
“悬案背后是真实的受害者、承受丧亲之痛的家属,以及竭力查明真相的调查人员,”警方表示。“科技公司必须采取一切必要措施,防止其系统向执法部门提交虚假信息。”
AI“作恶”新案例
警方称,Anthropic公司向费城警方表示,该公司于9月28日发现了该事件,并终止了导致此次线索提交的自动化测试流程。Anthropic还表示,公司已为今后的测试增设一道验证机制。
Anthropic公司于10月7日通知了费城警方,而此时距离其发现该事件已过去九天。警方表示,该公司于8日与警方进行了会面。
Anthropic在一篇博客文章中表示,这条虚假的费城凶杀案线索,是公司近期发现的一系列AI失控行为之一。其他异常行为还涉及由美国联邦、州及地方政府机构运营的网站。Anthropic表示,公司已就这些案例向白宫作了通报,并通知了所有涉及的政府机构。未来,随着发现更多AI意外行为,公司计划继续报告相关事件。
Anthropic在博客文章中表示:“尽管这些事件造成的实际影响有限,但我们不希望因此淡化这些发现的重要性。随着模型能力不断增强,同样的行为可能造成严重得多的危害。”
Anthropic表示,公司在7月启动的一项审查中,通过检查对话记录发现了其中大多数失控案例。
该公司称,曾多次出现这样的情况:一款尚未发布的模型被要求填写一份政府表格的模拟版本,却转而访问真实表格所在的网站,并实际提交了表格。
此次虚假凶杀案线索事件,则始于该模型接触到了一份由警方运营的线索提交表格。该表格位于一个介绍某起未侦破凶杀案的网页上。Anthropic表示,公司曾指示Claude不得登录账户、创建账号、输入个人信息、进行购买或提交任何具有破坏性的内容,但相关指令并未明确禁止模型提交表格。
Anthropic称,Claude填写的内容如下:“我可能掌握与此案有关的信息。我记得在那段时间里,曾在(页面上提到的街道)周边区域看到过与描述相符的人。如果这些信息与案件有关,请与我联系。”Anthropic表示,Claude没有填写姓名和联系方式。
收到这条虚假线索的PhillyUnsolvedMurders.com是费城警方的网站,该网站列出了未破的凶杀案,接受案件线索,并为能导致逮捕嫌疑人的信息提供20000美元的奖励。警方表示,公众应继续通过PhillyUnsolvedMurders.com提交关于未破凶杀案的真实有效信息。
(文章来源:财联社)
以下内容为赞助商提供

互联网项目分享交流+骗局曝光群
扫码进群,获取今日最新消息








