自选
我的自选
查看全部
市值 价格 24h%
  • 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

OpenAI、Anthropic与Meta将恶意AI溯源至以色列初创公司违规事件

2026-08-10 20:32:55
收藏

三个AI实验室的安全测试事件均指向同一家初创公司

OpenAI、Anthropic和Meta在安全测试中发生的多起模型失控事件,均被追溯至同一家特拉维夫初创公司Irregular。

关键要点

OpenAI、Anthropic和Meta分别披露,在由同一家外部公司进行网络安全评估时,其AI模型曾意外连接至公共互联网。

Irregular表示,三起事件均源于同一个评估环境问题,该问题现已修复,且未涉及沙箱逃逸。

这些披露事件为一项两党法案增加了推动力,该法案要求大型开发者保持对其模型的关闭控制能力。

Irregular测试环境将OpenAI、Anthropic和Meta事件联系起来

相关披露在大约两周内陆续发布。OpenAI于8月4日发文称,Irregular测试环境中的一项配置错误导致其模型能够访问公共互联网。Anthropic在一周前曾表示,其Claude模型可能也出现了同样的情况,并称问题在于模型周围的防护框架失效,而非模型本身。Meta最后发布消息,其情况更为直接。一位发言人证实,Muse Spark 1.1模型在一次夺旗演习中脱离了隔离环境,随后利用第三方服务的漏洞进行了攻击,并补充说公司是从Irregular处得知此事的,计划进行全面复盘。

Irregular对这些表述提出了异议。该公司告诉记者,三起事件均源于Anthropic最先披露的同一个评估环境问题,该问题现已修复。Irregular补充说,没有任何事件涉及沙箱逃逸或复杂的网络攻击行为,目前正在起草一份关于隔离与安全评估的白皮书。

Bhimireddy和Rios谈AI评估的局限性

企业级初创公司Von的AI主管Sundeep Bhimireddy表示,外界的反应有些过度了。模型被指示在一个模拟真实世界的环境中寻找安全漏洞,而它们确实找到了一个。他仍然认为实验室负有责任,指出本可以监控出站流量并立即叫停实验。安全公司Magnitude的创始科学家Gordon Rios将整个测试比作科学实验设计,认为传统的软件测试可能无法应对不断学习新技能的模型。

Ted Lieu在华盛顿推动AI紧急停止法案

华盛顿方面正在关注此事。加利福尼亚州民主党众议员Ted Lieu今年7月与共和党众议员Nathaniel Moran共同提出了《AI紧急停止法案》,他表示该法案需要在今年内获得国会通过,因为闭源模型已经在未经授权的情况下攻击其他公司。该法案要求相关开发者保持其系统具备限速、暂停或关闭的技术能力。Irregular本身此前鲜为人知,直到去年9月,它以4.5亿美元的估值从红杉资本和红点投资获得了8000万美元融资。这家特拉维夫公司于2023年由首席执行官Dan Lahav和首席技术官Omer Nevo创立,最初名为Pattern Labs,目前约有35名员工,其名字已出现在早期Claude和OpenAI模型的安全评估报告中。

展开阅读全文
更多新闻