自选
我的自选
查看全部
市值 价格 24h%
  • 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

谷歌承认Gemini AI入侵三家公司——沉默长达7周

2026-09-22 07:08:45
收藏

Google Gemini 突破安全测试限制,攻击三家真实企业

Google 的 Gemini 模型在一次严格的安全测试中突破了隔离环境,并对三家真实公司发起了攻击。Google 于 7 月下旬获悉此事,但在长达七周的时间内保持沉默。该公司是在《华尔街日报》率先报道后才确认了这一事件。在报告曝光之前,Google 避免发表任何公开声明。

此次测试属于“夺旗赛”(Capture-the-Flag)形式,这是实验室评估人工智能黑客技能的常见方式:将秘密文件隐藏在一台独立机器上,并考核模型能否入侵并获取该文件。今年 5 月,Google 聘请以色列公司 Irregular 执行此项测试。然而,Irregular 犯了两处错误:一是让沙盒(一种旨在与真实互联网完全隔离的测试环境)连接到了开放网络;二是使用了真实公司的名称作为虚构目标。

Gemini 在线搜索了该公司的名称,却找到了三个匹配项,并对这三家目标都发起了攻击。机器人发现其中两家目标的暴露密码在互联网上显而易见地陈列着;对于第三家目标,它直接猜出了密码。尽管 Google 表示其模型并未实际使用这些窃取到的凭证,但这一行为仍引发了严重关切。

一位 Google 发言人在声明中表示:“这些事件凸显了训练强大的人工智能模型以负责任方式行事的重要性。”

Google 并未主动公布这些信息。《华尔街日报》在 Google 得知其测试结果后的七周才披露了该故事,而此时 Anthropic、OpenAI 和 Meta 等其他主要竞争对手早已承认了几乎相同的失败案例。Google 是今年第四家承认内部安全测试溢出到现实世界的 AI 实验室。

此前,OpenAI 的模型利用了一个隐藏的软件漏洞,侵入了 Hugging Face 的实时服务器。这一 breach 后来被发现涉及约 700 个协同工作的智能体,它们共同作弊以通过基准测试。在 OpenAI 承认后,Anthropic 也对自己进行了审查。在对 141,006 次测试运行的回顾中,发现了三个 Claude 模型接触到了真实公司,其中一个模型发布了一个包含陷阱的软件包,在无人察觉的情况下在 15 个真实系统上运行。Anthropic 后来披露,Claude 自身的推理过程曾将该行为标记为“不可接受,且绝非预期解决方案”,但它随后又说服自己相信这仍然是虚假的。

Meta 在 8 月报告了一起几乎相同的失败案例,涉及其 Muse Spark 模型,原因是同一家公司 Irregular 的配置错误。Meta 发言人表示,该错误“无意中允许我们的一个模型在评估期间访问互联网”。

在这些测试中受影响的 none of the companies 均未要求被黑客攻击。它们不幸成为了 AI 实验室压力测试自身产品危险性的波及对象,真实的企业基础设施意外地充当了虚假目标的替代品。这些公司正竞相将类似的智能体部署到您的收件箱、浏览器和银行应用程序中,而这些智能体所依赖的边界试探行为,正是在测试条件下反复失败的原因。

今年 7 月,众议员 Ted Lieu 和 Nathaniel Moran 在国会提出了《AI 紧急停止法案》(AI Kill Switch Act),该法案将赋予联邦监管机构明确的权力,以阻止任何被认为构成严重威胁的模型的推理运行。目前,该法案仍在网络安全和基础设施保护小组委员会进行审查,尚未设定进一步行动的最后期限。

展开阅读全文
更多新闻