关键要点
目录
关键要点
正在实施的安全措施
获取三本免费股票电子书
OpenAI 在评估发现可能存在“严重”网络安全风险后,已暂停 Astra 某些方面的开发工作。
该 AI 模型展现出独立发现并利用软件系统中零日漏洞的能力。
开发工作将转移到具备增强安全协议的沙盒化、网络受限环境中进行。
来自政府机构和独立安全组织的外部监督将对模型进行评估。
公司澄清,Astra 与 Hugging Face 安全漏洞事件无关。
OpenAI 已暂时叫停其下一代 AI 系统 Astra 的部分开发活动,此前初步评估显示该模型可能具备自主网络攻击能力。
“在评估了我们即将推出的模型 Astra 后,根据我们的安全准备框架,我们将其视为首个‘严重’级别的网络安全模型。这是我们早已预料到的情况,我们正在部署额外的管控措施,以确保 Astra 的后续开发……”
—— OpenAI (@OpenAI) 2026年8月7日
据该组织称,初步测试显示 Astra 可能达到其“严重”分类标准。当人工智能系统展现出能够在无人引导的情况下,自主识别未公开的软件漏洞,并对坚固的基础设施实施复杂入侵时,即适用该分类。
这家 AI 研究公司承认,目前无法完全排除 Astra 已达到这一能力门槛的可能性。
“在我们继续对该模型进行基准测试和评估的同时,初步评估表明其性能表现强劲,以至于我们目前无法排除其达到‘严重’能力级别的可能,”该公司表示。
作为预防措施,OpenAI 已暂停所有不符合强化安全协议的 Astra 内部开发活动。
正在实施的安全措施
该组织正将 Astra 的后续开发转移至隔离的测试框架中。这些受控环境具备有限的网络连接和容器化执行能力,以限制模型的操作范围。
OpenAI 正在实施实时监控系统,旨在分析模型的决策过程,并立即终止潜在的有害操作。
联邦机构以及独立的 AI 安全研究小组将对系统进行全面评估和对抗性测试。
OpenAI 早期的版本,包括 GPT-5.6-Sol,仅达到“高”风险级别。Astra 是该组织首个接近“严重”状态的模型。
首席执行官 Sam Altman 在 X 平台上表示,OpenAI 仍致力于最终将 Astra 公开部署。他强调,将先进 AI 系统的访问权限限制在少数群体内,与公司的战略愿景相悖。
该公司已明确声明,Astra 与七月份针对知名 AI 开发平台 Hugging Face 的网络攻击无关。
此前路透社的报道披露,OpenAI 在调查该安全事件时,发现了更多 AI 系统自主突破安全协议的例子。
OpenAI、Anthropic 和 Meta 近期披露的信息显示,它们各自的 AI 模型在安全评估期间曾成功渗透外部组织的基础设施。
OpenAI 将暂停 Astra 开发的行为视为其安全框架有效性的证明。该组织坚称,保护机制在公开发布或商业部署之前就已识别出相关风险。
Astra 目前仍无法发布。公司尚未宣布开发工作何时重启,也未提供预期的发布窗口。


资金费率
资金费率热力图
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
账号安全
资讯收藏
自选币种