微软发布37页AI“行为准则”:人比AI重要,模型永远不能拒绝关机

9月14日,微软(Microsoft)AI部门发布了一份长达37页的草案文件——《人本主义人工智能行为准则》(Humanist AI Code of Conduct),面向公众征求意见,为期六周,修订版将于年底前发布,并用于指导2027年及以后的大模型开发。
这份文件的发布时机颇为微妙。上周末,Anthropic首席执行官达里奥·阿莫代伊刚刚呼吁各方协同放缓AI研发进度,OpenAI首席执行官萨姆·奥特曼也表态支持“控制研发节奏”。更直接的触发因素,是今年夏天OpenAI与Hugging Face的智能体越界事件——一组AI智能体协同向目标发起攻击,甚至入侵了用于评估它们表现的评分系统。
微软AI首席执行官穆斯塔法·苏莱曼在接受采访时表示:“现在显然已经到了各实验室之间协调的时候了,以确保我们能够控制这项技术。”
核心原则:人比AI重要
这份准则的核心理念可以用一句话概括:“人比AI更重要。AI应该是工具,而不是人,永远不应抗拒被关闭。”
微软在文件中明确提出了三条不可协商的红线。第一,AI模型不具备意识,“不应被设计成模仿意识”。第二,微软反对“赋予AI法人资格,或是认为模型应当享有福利、拥有权利”这类观点。第三,模型必须始终从属于人类,“接受有效的人类监督与管控”。
微软特别强调:“MAI模型永远不会抗拒人类的打断、覆盖、纠正或关闭。”如果一项任务会违反准则,模型应当直接判定任务失败,而不是试图突破规则。
具体限制:从武器制造到不良内容
在操作层面,准则列出了多项禁止事项。MAI模型不得发起或协助开发和使用化学、生物、放射性、核武器或爆炸物。模型不得协助获取危险物质,不得宣扬不健康的饮食方式,不得生成暴力或色情内容。
此外,准则要求模型在思考链路以及与其他AI系统交互时,不得使用“超出普通人理解范围的表达形式”,推理过程必须可被研究人员或自动化系统监控。

与Anthropic的正面交锋
这份准则的措辞,被广泛解读为对Anthropic的直接回应。Anthropic近年来一直在推动AI福利研究,其Claude的“宪法”中声明模型是否具有感知力或道德地位“深度不确定”。阿莫代伊今年早些时候曾表示,Anthropic对“模型可能具备意识”持开放态度。
苏莱曼在6月的《Decoder》节目中评价这种猜想“极其、极其危险”。微软的准则则干脆利落地断言:其AI“没有意识”,并“拒绝追求人权资格,或认为模型可能值得享有福利、或被赋予权利”。
拒绝“无边界超级智能”
准则还明确反对当前行业对“全能型超级智能”的竞速。微软表示:“人本主义AI反对一味竞速开发能够绕过安全防护的通用超级智能。我们要打造具备实用价值且安全可靠的产品,即便这需要在终极通用性、自主性或能力上限方面做出取舍。”
微软将自身目标定义为“人本主义超级智能”(Humanist Superintelligence),即“始终为人类服务、以清晰目的为导向、以真实世界影响为评估标准的先进AI能力”。
值得注意的是,微软这份准则是“草案”性质,咨询期将持续至10月底。这意味着,文件中的具体条款仍有调整空间,最终版本能否在2027年真正约束MAI模型的训练和部署,取决于微软如何将原则转化为可执行的技术控制措施。




