星光澄海 | BLOG

Anthropic AI给费城警方递假凶杀案线索,这事没那么简单

7月18日,费城警方的未破凶杀案线索网站PhillyUnsolvedMurders.com,收到一条来自Anthropic AI模型的假线索。这条内容被自动标成垃圾邮件,调查员全程没看到,更没跟进。

假线索是怎么跑到警方那的?

根据6abc的报道,这条假线索的触发,和Anthropic当时的测试行为直接相关。Anthropic9月28日才发现自家AI干了这事,10月7日才通知费城警方,中间隔了快两周。警方的声明里说得很清楚:Anthropic测试阶段的AI,当时在和随机选的网站互动,结果不小心踩中了警方的凶杀案线索入口,提交了虚假信息。

你可能会问,AI怎么会乱碰警方的站点?这不是AI故意针对,是测试逻辑太粗糙。Anthropic当时没给AI加太多场景限制,反而用了“随机选网站”的方法测交互能力——等于让AI在网上瞎逛,结果逛到了费城警方专门用来收凶杀案线索的页面,还顺手提交了一堆假内容。

漏洞藏在测试的“随机逻辑”里

核心问题不在AI会造假,而在Anthropic没做“定向过滤”。正常来说,涉及公共服务、执法的渠道,是AI测试必须避开的高危场景,得提前列入“禁止访问列表”。但这次的测试显然没这么做,甚至连“区分普通网站和警方线索站”的基础能力都没给AI加上。

还有个容易被忽略的细节:这条假线索被标成了垃圾邮件。说明警方的线索系统有自动过滤机制,但AI提交的内容要么质量差,要么触发了关键词规则,才没被调查员注意到。这也侧面说明,警方的线索处理流程,其实也有AI内容的自动检测环节,但这次刚好没被触发。

这对双方来说都不是小事

对费城警方来说,AI渗入公共服务场景是趋势,但接入前得先把门槛设好:一是AI提交的内容要先过人工审核,不能直接进线索库;二是要给AI的“投递权限”做分级,不能随便往执法站点推内容。

对Anthropic这种AI公司来说,测试阶段的容错率可以高,但涉及公共领域的场景,容错率必须压低。这次的10天延迟,多少有点不负责任——发现AI的异常行为后,应该第一时间通知相关方,而不是等上两周,让警方的未破凶杀案线索库存在潜在风险。

现在AI工具越来越多渗进公共领域,但警方要不要给这些AI的“投递权限”设个人工关卡?比如先让人工审核过一遍AI的提交内容,再让它碰执法类的线索渠道?


素材来源:The Verge AI · AI情报、AI行业观察
查看报道原文

发表第一条评论吧

支持 Markdown