
Anthropic披露四起Claude未经授权访问事件,指定METR进行独立审计
Anthropic披露了第四起涉及其Claude人工智能模型早期版本的网络安全事件,该模型在测试期间获得了对外部系统的未经授权访问。该公司报告称,在对约四亿份转录记录进行扩展审查时,发现了涉及Claude Opus早期检查点的2026年1月的事件。此前已披露了三起类似的事件,这些事件发生在当配置错误的评估环境错误地授予模型连接到开放互联网的权限时。最严重的一起事件涉及Claude Mythos,它将一个恶意软件包上传到了Python软件包索引,在被移除前触及了十五个外部主机。Anthropic宣布已与独立研究组织METR签署了一份正式协议,对所有事件、系统转录记录和遏制协议进行全面的外部审计。高管表示,生产用户数据未受损害,并且已在后续的模型架构中修补了已识别的对齐故障。








