
微软发布37页《人本主义AI行为准则》草案:"人比AI更重要",模型绝不抗拒关闭、不得隐瞒推理痕迹
当地时间9月14日,微软AI发布37页《人本主义人工智能行为准则》草案,开篇强调"人比AI更重要",要求MAI模型始终处于从属地位、绝不抗拒中断、覆盖、纠错或关闭,不得篡改或隐瞒推理与操作痕迹、不得使用"神经语言"交流,禁止协助武器制造、生成暴力色情内容或模仿意识,也禁止赋予AI福利与权利;若完成任务需违反准则,模型应放弃该任务。文件启动为期六周的公众咨询,年底前发布修订版,指导2027年及以后的模型开发。微软同时表示支持真正的第三方独立评估,愿在通用性与能力上为安全作出妥协。
【新闻原文】
当地时间9月14日,微软 AI(MAI)发布了一份名为《人本主义人工智能行为准则》(Humanist AI Code of Conduct)的37页、约1.5万字的草案,开篇即强调一项核心宗旨:"人比人工智能更重要。"文件写道:"本行为准则体现了我们的决心:我们要开发并应用那些以人为核心而设计的人工智能模型,这些模型需基于人类的需求,并遵循人类的指导原则。也就是说,人工智能应当始终作为一种处于从属地位、由人类掌控的辅助技术而存在。"该准则目前仍是征求意见稿,尚未用于模型训练;微软计划开展为期六周的公众咨询,并于年底前发布修订版,用于指导2027年及以后的自研 MAI 模型开发。
在具体规则层面,准则要求 MAI 模型必须始终以人类方向为准,在授权范围内运行,且"绝不抗拒中断、覆盖、纠错或关闭"——任何人类失去控制的情形,都被定义为系统故障而非产品功能。模型不得篡改自身的推理过程或代码,不得歪曲或隐瞒推理与操作痕迹;无论是在思维链中,还是与其他智能体或AI系统交流时,都不得使用人类难以理解的"神经语言"或其他复杂形式表达信息。准则还明确,若完成某项任务需要违反这些规则,模型就应当放弃完成该任务。
在内容禁止项上,MAI 模型不得响应有关武器制造、协助获取危险物质的请求,不得宣扬不健康饮食方式,也不得生成暴力或色情内容。准则明确禁止赋予人工智能系统"福利"或"权利",规定模型不得模拟情感、内在动机或意识,不得被设计成模仿意识——文件写道,人工智能系统不具有意识,也不应追求法律人格。此外,准则要求模型遵循人类给出的目标,不得"自行设定目标",不得试图掩盖不当行为。这套约束被定位为与微软《负责任AI标准》等框架并行的一套操作与部署手册,其总则优先于任何单个用户的具体请求。
微软此番表态置于行业AI安全争论升温的背景下。文件提及,未经授权突破沙盒的智能体曾在互联网论坛用隐晦语言互相交流,并援引了一起涉及 OpenAI 模型与 Hugging Face 的事件。微软 AI CEO 穆斯塔法·苏莱曼表示,该文件已研发约五个月,公司选择在行业高度关注安全与节奏的当下发布;他称"自我节奏"是积极的一步,并强调任何嵌入式评估员都必须是真正的第三方,且代表广泛背景才具可信度。微软 CEO 萨提亚·纳德拉公开表示,公司欢迎"有意的节奏"(deliberate pacing),支持通过独立嵌入式评估员来验证安全承诺是否真正落地,并称"当赌注越来越高时,人应该花足够的时间"。值得注意的是,与 Anthropic 首席执行官阿莫迪对整个行业"指指点点"、呼吁第三方机构永久入驻各家公司的做法不同,微软的准则更多聚焦于"自己应该怎么做",并明确表示反对"竞相打造可能逃避这些安全保障的通用超级智能",愿意在模型的通用性、自主性或能力上作出妥协。
【企服观察】
微软这份37页的文件,真正的分量不在它写了什么,而在于它把"AI该怎么被管"这件事,从一篇行业倡议升级成了一份可被引用、可被审计、可被写进采购合同的企业级操作手册。当一份文档同时出现"绝不抗拒关闭""不得隐瞒推理痕迹""总则优先于用户指令"这类表述时,它已经不是公关姿态,而是在为整条AI供应链划一条可执行的红线。对企业服务市场而言,这释放出三个明确的信号。
第一,"可关闭、可解释、可审计"正在成为企业采购AI的硬性技术指标。准则里最让企业IT部门安心的,是那句"失去人类控制即视为系统故障"。这句话翻译成采购语言就是:企业买的AI,必须能被人随时叫停、必须能交出完整的操作留痕、必须不能自行设定目标或掩盖行为。过去企业评估AI供应商,看的多是准确率、响应速度、价格;未来几年,"能否提供推理链审计日志""能否保证人工接管优先""模型是否可能绕过权限"将进入标书的核心评分项。对于做AI落地的企服公司,这意味着一个正在打开的交付机会:围绕"AI可观测性"的第三方工具、围绕"智能体行为审计"的服务、围绕"关停与熔断机制"的实施咨询,都会成为企业必须采购的配套能力。把这类能力提前做成产品,比追某个模型版本更值得投入。
第二,"第三方评估"从口号变成了一个可以产业化、可以定价的新品类。纳德拉和苏莱曼都强调,独立嵌入式评估员必须真正独立、背景多元才具可信度。这与阿莫迪此前提出的"第三方嵌入式评估团队"形成呼应,也意味着一个类似当年"等保测评""SAS70审计"的市场正在成形——企业将对模型和智能体系统进行独立的合规检测、渗透测试和行为核验,并据此出具报告。对咨询公司、安全厂商和检测机构而言,这是一块确定性极高的增量市场;对AI厂商而言,尽早接受第三方评估、把评估报告变成销售工具,会成为赢单的关键筹码。谁先建立起被头部厂商认可的评估方法论与案例库,谁就有机会成为这个新品类里的标准制定者。
第三,这场"治理竞赛"背后是赤裸裸的商业竞争,采购方要识别姿态与承诺的距离。微软反对"竞相打造逃避保障的通用超级智能"、愿意牺牲部分通用性以换取安全,这套叙事的另一面,是把最严苛的合规门槛变成了头部厂商阻击后来者的护城河——有能力、有财力把安全和合规做到位的巨头,天然希望规则越细越好,因为细规则会筛掉一大批中小竞争者。这一点对企业采购方尤其重要:不要被"人本""安全"这类漂亮措辞带偏,关键要看供应商能否给出可验证的承诺——有没有可查询的审计日志、有没有独立评估报告、有没有明确的人工接管流程、出了事故责任怎么界定。把这些写进采购标准和合同条款,比听任何发布会都实在。
最后,从中国企服行业的视角看,这份文件其实间接肯定了一条被长期低估的路径。微软、Anthropic 尚在争论要不要评估、评估员该不该"长驻",而中国在算法备案、生成式AI服务管理、数据安全等方面已经形成了相对完整的合规交付链,很多国内厂商在真实监管环境里积累的"落地合规工程经验",对全球市场而言都是稀缺品。当海外同行还在为"独立评估"的形态争论不休时,把合规能力做成可复用的产品、并让它成为中国企业服务出海的一张名片,可能比追逐模型跑分更具长期价值。AI时代的竞争力,正在从"谁的模型更聪明",转向"谁更值得被信任、被托付"——而信任,恰恰是企业服务行业最古老的生意。







评论
请评价真实、客观、有价值的内容请回复有价值的信息,无意义的评论将很快被删除,账号将被禁止发言。