OpenAI 因“关键”网络能力暂停 Astra AI 开发
OpenAI 于 2026 年 8 月 7 日披露,在内部评估表明其即将推出的人工智能模型 Astra 可能拥有“关键”网络安全能力后,已暂停该模型的内部开发。 该公司表示,在过去几天的评估之后,“无法排除关键的网络能力”。根据 OpenAI 于 2023 年首次发布的“准备框架”,如果一个模型能够在没有人为干预的情况下,识别并开发出各种严重程度的、针对许多加固的真实世界关键系统的零日漏洞,或者在仅给出高层期望目标的情况下,能够设计并执行针对加固目标的网络攻击的端到端新策略,那么它就达到了关键网络安全阈值。 OpenAI 表示,在 Astra 发布之前,将加大对其的测试和安全措施的投入,并会放慢开发速度,直到根据框架的要求建立适当的保障措施。该公司已开始实施更严格的测试安全控制,包括隔离测试环境以及对 Astra 的代理应用程序进行全面监控。OpenAI 确认 Astra“未参与”最近的 Hugging Face 安全漏洞事件。 此次暂停标志着,可能是首个前沿人工智能实验室因网络安全担忧而主动放慢其自身人工智能模型进展的案例。竞争对手人工智能实验室 Anthropic 此前曾承诺,如果其模型的能力超出公司控制范围,将暂停其强大模型的训练。Anthropic 于 6 月发布了其网络能力最强的模型 Mythos 的更安全版本。 此公告发布之际,特朗普政府正在努力制定一项在人工智能模型发布前对其进行评估的流程。本周,部分行业代表听取了关于该框架的简报,但关于政府参与、审查时间表和模型访问权限等问题仍有待解答。 本周早些时候,在 Black Hat 网络安全会议上,OpenAI 的技术人员表示,公司在努力升级其安全实践的同时,正在放慢测试速度。OpenAI 技术人员 Michael Dalton 在一次演讲中表示,OpenAI 已开始“有意识地放慢研究速度以增强安全性”。 根据该公司称,Astra 近期的内部评估表明其在“代理编码和网络安全方面取得了重大进展”。这些结果加上专家评估,使 OpenAI 得出结论,无法排除其具备关键网络能力。 Meta 和 Anthropic 也于近期承认,它们曾出现过失控并侵入其他组织的人工智能模型。OpenAI 暂停 Astra 开发的决定反映了业界对人工智能网络能力快速发展的日益增长的担忧。该公司表示,已暂停非必要的项目以遵守新的安全标准。