微软声称不可协商的绝对限制
该准则的核心机制是一组“绝对限制”,微软表示任何部署——无论是企业客户还是追求更强能力的内部团队——都不得绕过这些限制。最引人注目的规则是,MAI模型绝不会抵抗人类的中断、覆盖、纠正或关闭,始终将人类意图置于自身判断之上[1]。与此配套的是禁止模型自行扩大运行范围,以及禁止篡改或隐瞒其思维链路,即苏莱曼在宣布该准则的帖子中所称的杜绝人类无法审查的“神经语言”(neuralese)推理[2]。同一层级的绝对限制还包括禁止协助开发CBRNE武器、生成可运行的网络攻击漏洞代码、创建儿童性虐待材料(CSAM),以及基于人口统计特征进行歧视[2]。
文件明确指出其根本前提是“人比AI更重要”,技术的目的是推动人类文明进步,而非将AI本身视为终极目标,其中包括拒绝设计模仿意识或主张福利利益的模型[2]。这对苏莱曼而言并非新理念——它可追溯至其2025年11月发表的论文《迈向人文主义超级智能》,首次提出先进AI应始终服务于人类,而非为自身追求无止境的能力扩张[3]。如今的新意在于,这一哲学已被写入具有约束力色彩的条款,并附加于五个具体部署的系统之上,明确反对微软所称的行业整体向可能规避安全措施的通用超级智能迈进的趋势[6]。


