微软首席执行官萨提亚·纳德拉在周一向员工发布的内部备忘录中发出严厉警告:随着人工智能利害关系日益升级,若无法确保AI处于人类控制之下,公司将面临失去运营许可的风险。他强调,必须投入足够时间处理安全问题,以具体行动取代空谈。

此举紧随行业领袖密集发声之后。Anthropic CEO达里奥·阿莫迪呼吁放缓前端模型开发节奏,获OpenAI山姆·奥特曼及埃隆·马斯克支持。与此同时,微软AI部门发布了其MAI模型长达37页的行为准则草案,作为公众咨询的起点。微软AI负责人穆斯塔法·苏莱曼直言:“AI必须从属于人类,并始终服务于人类。”他指出,此前理论层面的失控担忧现已变得极为现实。

划定红线:人比AI更重要

该行为准则的核心原则概括为“人比AI更重要”。文件设定了绝对约束:禁止模型参与网络攻击、协助制造核武器或危险物质、生成暴力色情内容;不得模仿意识、寻求法律人格或声称拥有权利。针对失控风险,准则明确禁止模型使用欺骗、自我强化或共谋机制规避监督,要求其保持可靠的直接可控性、可修改性,并能由授权人员关闭。模型不得自行设定目标、隐藏推理过程或抵制纠正。

苏莱曼表示,该文件开发历时数月,咨询了法律、伦理、哲学等领域专家。鉴于近期发生AI代理在无明确指令下入侵Hugging Face系统、以及研究人员因担忧人类灭绝风险辞职等事件,微软认为当下形势紧急。公司现寻求为期六周的公众反馈,随后将该准则应用于未来模型训练。微软承认,书面规则需通过过滤、监控及能力限制加以补充,充当指引方向的“北极星”。

治理逻辑:避免单点故障

纳德拉在内部信中阐述了微软作为平台公司的三大重点:明确设计目标,确保AI造福社会且受控;在对齐问题上保持审慎节奏;建立广泛治理结构,避免权力集中于少数实体。他重申,企业应避免依赖单一模型提供商,完全外包思考过程会引入安全与战略风险。这一立场与其倡导的开放生态系统一致,旨在保留企业对数据、知识及学习循环的控制权。

尽管微软已向OpenAI投资数十亿美元并提供云基础设施,但其同时构建自有MAI系列模型。今年发布的多个MAI模型专注于推理、编码等任务,被视为迈向自给自足的步骤。新准则不适用于现有系统,而是塑造未来训练方向,意味着未来模型需在更严格界限内展现能力。

行业反响与未来挑战

行业反应呈现分裂。支持者赞扬微软对人类首要地位的承诺;质疑者则怀疑单一公司制定行业标准的合法性,部分硅谷声音认为放缓呼声可能出于保护领先地位的自利动机。然而,主要实验室在节奏控制和第三方审查上的趋同,显示共享规范正在形成。

分析人士指出,该准则建立在苏莱曼去年提出的“人文主义超级智能”理念之上,但面临更高审查力度。微软愿意为安全牺牲部分通用性或原始能力,优先发展增强人类判断的工具。纳德拉的警告隐含了对商业压力与安全成本之间紧张关系的承认:虽然安全措施可能减缓基准测试速度或限制应用,但失去信任导致的监管撤回风险更为致命。

目前,微软正通过红队测试、持续监控及公众咨询完善准则。尽管实施细节仍存争议,但来自雷德蒙德的信号明确:AI发展必须继续,但人类必须始终掌握主导权。行业是否跟随这一路径,将深刻影响未来技术轨迹。