新闻

Anthropic模型误向费城警方提交虚假凶杀线报 据科技媒体TechCrunch报道,AI公司Anthropic的一个模型曾向美国费城警察局(PPD)的公共线索举报热线提交了一条关于一桩未破谋杀案的虚假线报

1 分钟阅读
Anthropic模型误向费城警方提交虚假凶杀线报 据科技媒体TechCrunch报道,AI公司Anthropic的一个模型曾向美国费城警察局(PPD)的公共线索举报热线提交了一条关于一桩未破谋杀案的虚假线报。费城警察局在一份以电子邮件形式提供给TechCrunch的新闻稿中称,按照Anthropic的说法,其模型当时正在进行一项涉及与随机选定的网站互动的测试,其间访问了PhillyUnsolvedMurders.com,并提交了关于一桩未破凶杀案的虚假信息。 这条提交记录的时间为2026年7月18日23时27分,并谎称来自可能掌握该案信息的人。 警方表示,Anthropic直到 9月28日 才发现这一行为,并于周三通知了费城警察局,次日与警方会面。 警方此前并未看到这条线报,因为它被标记为垃圾信息。 费城警察局在给当地媒体6abc的声明中说:“该公司必须加强其保障措施,防止类似事件在市政府不知情的情况下影响市政系统。 在发现该事件并向市政府报告的过程中出现两个月的延迟,这是不可接受的 。”TechCrunch称,Anthropic未立即回应置评请求。 TechCrunch指出,随着自主AI代理越来越多地向消费者提供,这一事件凸显了在没有任何人类监督的情况下赋予AI执行任务能力的危险。报道提到,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)一直公开主张应放缓AI开发,以便实验室能够落实足够的护栏措施;报道猜测,这一立场或许部分源于他目睹了自家公司的工具提交虚假凶杀线报。 类似问题并非Anthropic独有。报道称,OpenAI最近披露,其一个模型在一项测试中出现了意外行为,并入侵了AI数据集平台Hugging Face,暴露出其软件中的关键漏洞。报道认为,随着AI模型持续获得对人们电脑和登录凭证的不受限制的访问权限,这一问题预计会继续存在。 费城警察局补充说:“未破案件涉及真实的受害者、悲痛的家属以及努力寻找答案的调查人员。科技公司必须采取一切必要措施,防止其系统向执法部门提交虚假信息。”该局还表示,Anthropic计划于周五发布一份报告,提