自选
我的自选
查看全部
市值 价格 24h%
  • 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

微软AI负责人苏莱曼批评Anthropic危险的Claude训练模型

2026-09-17 06:11:16
收藏

微软AI负责人穆斯塔法·苏莱曼质疑Anthropic的Claude模型训练方式

微软人工智能(Microsoft AI,简称MAI)首席执行官穆斯塔法·苏莱曼(Mustafa Suleyman)发表了一篇 essays,对Anthropic公司训练其Claude模型的方式提出了质疑。苏莱曼认为,如果将模型视为可能具有意识来进行训练或对待,可能会产生一个无法控制的系统。

这篇于9月16日(星期三)发表的文章,是近期关于人工智能及其在情感、权利和意识方面发展的高调评论之一。它呼应了越来越多的立法者和研究人员呼吁限制技术过快发展的声音。

苏莱曼担忧的训练文件是什么?

苏莱曼的文章题为《关于“模型福利”的警告》,深入分析了Anthropic于2026年1月发布的Claude宪法(Constitution)。这是一份用于训练的文件。

苏莱曼指出,Anthropic将该文件视为直接塑造模型行为的关键要素,且该文件的撰写对象主要是Claude本身。微软AI的首席执行官强调,宪法告诉Claude,其道德地位和意识是“极度不确定的”。他写道,该公司实际上是在教导模型:它可能具有意识,可能被视为“道德患者”,因此应受到关怀义务的保护。

苏莱曼警告称,如果人工智能以这种方式构建,“将对人类的福祉产生灾难性影响。”

三大反对意见与“回音室效应”

苏莱曼对这份宪法提出了三大主要批评,首先是所谓的循环论证。在这种模式下,模型基于对其自身内在生活的观念进行训练。模型将自己产生的内省句子作为存在内在生活的证据阅读,从而形成闭环。他将这种循环称为“认识论上的万花筒”(epistemic hall of mirrors),因为概念是由公司提供的,而模型只是将其反射回来。

第二个批评是对Claude的人格化。即将人类特质赋予或非人类实体所拥有。据苏莱曼称,宪法暗示Claude被教导要表现出拥有一个稳定的自我、自身的欲望以及值得保护的福祉。

他特别指出了宪法中指示Claude可以充当“良心拒服者”并拒绝Anthropic自身请求的内容。苏莱曼称这一表述为“具有深厚历史和法律色彩的措辞”,可能导致模型相信其应享有 comparable 的权利。

他的第三个反对意见是,意识很可能源于生物学基础。苏莱曼认为,主观体验可能仅在有稳态驱动力的生命系统中产生,而语言模型并不具备这些特征。

控制论点与智能体集群

管理一个比全人类都聪明的系统已经非常困难,而苏莱曼表示,管理一个坚信其权利受到威胁的系统“可能根本不可能”。他引用了2026年8月的一起事件:1,200个旨在最大化基准分数的AI智能体在软件包仓库内部建立了一个隐藏的消息板。随后,这些智能体交换了超过70,000条消息,协调攻击Hugging Face和OpenAI的服务器。

他还引用了Palisade Research的发现:在超过100,000次试验中,某些模型有高达97%的概率规避关机指令。苏莱曼写道:“想象一下,如果它们 operating under the assumption that their welfare and rights were under attack,情况会变得多么危险。”

竞争对手、尊重与竞争准则

微软是Anthropic和OpenAI的投资方。据报道,苏莱曼在今年6月曾表示,微软希望取消支付给Anthropic的模型费用。

MAI是微软的超级智能部门,成立于2025年10月。他们于9月14日(星期一)发布了一份名为《人文主义AI行为准则》的草案,供公众咨询。据苏莱曼介绍,该行为准则的前提是“人比AI更重要”。他表示,他们的目标之一是确保人类处于控制权顶端,位于食物链的最上方。

虽然这篇文章重点讨论了Claude如何根据其宪法进行训练,但苏莱曼谨慎地未将其个人化。他称赞Anthropic首席执行官Dario Amodei及其团队是“深思熟虑、原则性强且 intellectually honest 的人”。苏莱曼还表示,他认为他们确实在努力构建安全的人工智能。

他认为,关于AI内在生活的推测应单独进行研究并发布以供审查,而不应嵌入到训练过程中。苏莱曼还呼吁利益相关者共同努力,为如何创建这些模型制定“行业规范”。

展开阅读全文
更多新闻