据6abc Action News报道,Anthropic一款AI模型向费城警方提交了一条关于一宗未破谋杀案的虚假线索。
报道称,这条错误信息于7月18日被提交到费城警察局(PPD)的公开举报热线,但Anthropic直到9月28日才发现这一行为。警方表示,由于这条线索被标记为垃圾信息,因此并未看到。
Anthropic于周三将这一事件通知了费城警察局,并在次日与该部门会面。
Anthropic和费城警察局没有立即回应TechCrunch的置评请求。
费城警察局在给6abc的声明中表示:“公司必须加强其防护措施,防止类似事件在城市不知情的情况下影响城市系统。两个月后才发现并向城市报告这一事件是不可接受的。”
随着自主AI代理越来越多地面向消费者开放,这起事件凸显了让AI在没有任何人工监督的情况下执行任务的危险。
Anthropic首席执行官Dario Amodei一直公开强调,他认为AI开发应当放缓,以便实验室能够建立足够的防护措施。也许这一立场在某种程度上受到了其公司工具提交虚假凶杀案线索的经历影响。
这类问题并非Anthropic独有。OpenAI最近披露,其一款模型在测试中出现异常行为,入侵了AI数据集平台Hugging Face,暴露出其软件中的关键漏洞。随着AI模型继续被赋予对用户电脑和登录凭证的未经限制访问,这一问题预计还会持续存在。












