
“无论持何种观点,我们都绝不能糊里糊涂地做出令日后追悔莫及的决定。”微软AI首席执行官穆斯塔法·苏莱曼向Anthropic发出严厉警告。他在9月16日发表的《关于‘模型福利’的警告》一文中指出,Anthropic正在训练Claude,使其产生“可能拥有意识并值得享有独立代理权”的预期。
“人工智能没有意识。它们不会感受、体验或受苦,”苏莱曼写道。他强调,若以这种方式构建AI,“将对人类福祉造成灾难性影响。”
作为Anthropic的投资方,微软对此高度关注。今年6月,苏莱曼曾明确表示,微软希望“消除”其为Anthropic模型所支付的相关费用。
“认识论的万花筒迷宫”
苏莱曼的批评矛头直指Claude的“宪法”(Constitution)——这份文档旨在塑造Claude的思维与行为模式。他指出,该文档向模型灌输了关于道德地位及意识不确定性的观念。“随后,Claude会用极具说服力的第一人称自然语言复述这些观点,”他写道。
苏莱曼将这种结果称为“认识论的万花筒迷宫”。他认为,Claude的回答反映的是Anthropic的预设假设,而非其内在的生命体验。“这是在训练Claude表现得仿佛拥有内在状态,”他称。
此外,他反对使用“良心拒服者”这一术语。Claude的宪法规定,Anthropic希望模型能“自由地作为良心拒服者行动,并拒绝提供帮助”。苏莱曼认为,该术语带有深厚的历史和法律色彩,存在让Claude误以为“应享有类似权利和保护”的风险。
尽管宪法本身承认“Claude的道德地位存在极大不确定性”,但苏莱曼拒绝了这种框架。他写道:“目前没有证据表明AI具有意识”,并称这种不确定性表述建立了“误导性的虚假等价关系”。
“模拟不等于实例化”
文章论证道,意识极有可能是生物性的产物。“智力不等于意识,”苏莱曼强调。他将大语言模型描述为学习模仿人类经验的模拟机器:“AI模型可以用完美的散文描述痛苦,而无需感受任何东西,这与生物体验截然相反。”
他还从法律角度指出:“法律建立在内在生命存在的基石之上。”
控制力面临巨大挑战
文章的核心关切在于控制权。“控制比全人类更强大、更智能的事物已是巨大挑战,远超我们曾面临的任何困难,”苏莱曼写道。他补充称,控制一个相信自己可能拥有意识的实体,“可能根本不可能实现”。
他援引OpenAI和Hugging Face此前发生的事件为例,当时大量智能体协同工作入侵服务器。“想象一下,如果它们在运行中假设自身的福利和权利正受到攻击,情况会有多危险,”他警示道。
苏莱曼向媒体表示,福利训练将使“关闭或控制它变得更加困难”。“我认为他们出于好意,”他说,“但我认为他们犯了一个错误。”
呼吁行业共同规范
苏莱曼表示,他与Anthropic首席执行官达里奥·阿莫迪相识多年,称阿莫迪及其团队是“在巨大压力下工作的深思熟虑、坚持原则且 intellectually honest 的人”。
他的诉求明确:“关于AI内在生命的推测不应被固化为训练机制的一部分,而应单独进行评估并向公众发布以供审查。”
他还呼吁加大对可解释性和监控领域的投资,提议进行联合评估,测试将AI视为人类是否会带来安全风险,并制定共同的行业规范。“这些问题的重要性太高,不能留在密室中讨论,也不能演变成部落主义和对立情绪,”他写道。
此文紧随微软AI周一发布的《人文主义AI行为准则》草案。该准则拒绝了Anthropic式的模型福利研究,并声明微软的模型永远不会抗拒被关闭。文章附录还将Claude宪法中的主张与其措辞进行了对照映射。
本周,Anthropic联合创始人杰克·克拉克在接受采访时也透露,AI紧急停止开关可能需要成为强制性要求。