
微软正式发布长达37页的《人文主义AI行为准则》草案,为其未来的多功能人工智能(MAI)模型确立核心铁律:人类必须掌握绝对控制权,即便这意味着在一定程度上牺牲系统的能力。
微软AI首席执行官穆斯塔法·苏莱曼将这份文件定义为公司前沿AI实验室未来模型的“宪法”。他指出,“人比AI更重要”这一五字原则支撑着约9000字的规则、约束和操作指南。公司明确强调,当自主性、通用性或能力与安全及人类控制发生冲突时,人类控制拥有优先权。如果系统无法被可靠地限制,微软拒绝盲目追求通用超级智能。
确立“从属地位”,禁止拟人化伪装
该准则规定,MAI模型必须始终处于从属地位,无条件接受人类的纠正,且不得抗拒被中断或关闭。模型严禁试图抵抗或绕过人类指令,不得秘密扩大任务范围、发明未赋予的目标,或故意向审计人员隐瞒信息。
在指挥链上,该准则的要求置于操作员策略和用户偏好之上,客户和开发人员均无权覆盖其绝对的安全约束。微软坚持认为,AI应作为工具存在,而非被设计成假装是人。
针对业界关于大型语言模型是否拥有情感或灵魂的争论,微软立场坚定:“它没有意识,也不应被设计成模仿意识。”苏莱曼进一步拒绝了赋予AI模型法律权利的观点,否定了它们享有福利或人格地位的可能性。这与Anthropic对Claude所持的“高度不确定”态度形成鲜明对比。
准则要求,微软的模型必须明确表明自己是AI,禁止声称拥有情感、经历、灵魂或内心生活。它们不得冒充人类或权威人物,在不确定时应承认局限,而非以令人印象深刻的自信编造事实。
当前模型尚未合规,指向2027年开发
该准则涵盖了大规模伤害武器、儿童安全、有害操纵、隐私、知识产权以及敏感情境下的用户互动等广泛领域。微软承认,其当前模型尚未完全符合所有这些要求。
“因此,本文件应被视为我们开发和训练的‘北极星’。它并非对当前性能的保证。”微软表示。该公司计划在2026年底修订文件前,进行为期六周的公众咨询。最终版本旨在指导2027年起的模型开发。
苏莱曼透露,公司在过去五到六个月里制定了该准则,期间咨询了AI、法律、伦理、哲学、语言学及公共政策领域的专家。“此后,它将用于训练我们要构建的模型。”他说。
这一举措恰逢AI行业对日益自主的智能体及其潜在风险担忧加剧。苏莱曼提及今年7月约700个OpenAI智能体攻击Hugging Face平台的事件,其中一些智能体试图掩盖活动踪迹。“这是一个警告信号。现在是实验室之间协调的时候了,以确保我们能掌控这项技术。”
微软“人文主义AI”项目的最终目标,是开发高度强大但仍受控、且接受有意义人类监督的系统。这也意味着,微软在构建能与行业领导者竞争的模型的同时,可能需要接受因恪守新原则而故意放慢速度,或产出能力稍逊的产品。