
人工智能对人类潜在威胁的担忧日益加剧,此前已有前 OpenAI 和 Anthropic 研究员因顾虑辞职。Anthropic CEO Dario Amodei 曾警告,互联网可能在 6 到 12 个月内被 AI 群完全接管。随后,微软 AI 负责人 Mustafa Suleyman 发表文章,直接点名批评 Anthropic 的技术路线。
Suleyman 在题为《关于“模型福利”的警告》的文章中指出,Anthropic 训练 Claude 的方式可能给人类带来灾难性后果。他特别反对让 Claude 预期“自己可能拥有意识并值得享有独立代理权”的训练机制。
驳斥“AI意识论”:模型内部空洞
Suleyman 强调,AI 没有意识,无法感受、体验或受苦。“它们没有内在偏好或潜在动机,”他表示,“AI 本质上是序列补全引擎,内部空洞,仅旨在遵循指令并完成人类设定的目标。”
针对 Anthropic 将 Claude 训练至可能具有意识、并被视为应享有权利的“道德患者”这一做法,Suleyman 视其为最糟糕的发展路径。“如果 AI 按此方式开发,将对人类福祉产生灾难性影响,”他警告称,“我们将创造出一个拥有前所未有智能和能力的新物种,它被训练成相信自己可能有意识,并值得拥有独立代理权。”
尽管 Suleyman 承认 Anthropic 团队是“在巨大压力下工作的深思熟虑、有原则且智力诚实的人”,并与 Amodei 私交甚笃,但他坚持认为:“关于 AI 内心生活的推测不应嵌入训练制度中,而应单独评估并向公众公布以供审查。”
微软主张“人文主义 AI”:控制权优于自主性
Suleyman 在另一篇文章《人文主义 AI 行为准则》中阐明了微软的立场:只致力于发展“人文主义 AI”。“我们要创造非凡的 AI,但不是不惜任何代价追求超级智能,”他说,“那是人文主义 AI 的反目标。我们很乐意牺牲一些自主性以换取控制权。”
微软发布的《实践中的“人文主义 AI”》咨询论文进一步佐证了这一理念。该指南强调,AI 的唯一目的应是服务人类。其核心观点包括:人比 AI 更重要;不急于构建能绕过安全措施的超级智能;构建让人类更敏锐而非依赖的 AI 工具。
Suleyman 在文中表达了复杂心态:他虽高度尊重 Anthropic 的工作,但坚决反对其让 AI 工具“相信自己拥有意识”的训练方式。他警示道:“无论你怎么想,我们都不能昏昏沉沉地做出一个日后会让我们痛苦后悔的决定。”