快讯
微软发布MAI模型行为准则:思维可读、无内在生命、不享权利
微软AI发布面向自家MAI模型的行为准则,强调人类控制优先,要求推理过程可被人类理解,并明确拒绝赋予模型权利或福祉地位。该准则目前不用于训练,修订版预计2026年底出炉。
微软发布MAI模型行为准则
据the-decoder报道,微软AI已为其MAI模型发布一份行为准则文件,列出价值观、行为边界以及目标冲突时的处理方式。该文件据称将置于规则体系顶层,指导训练、技术控制与评估,而运营方规则和用户请求排在其下。准则目前不用于训练模型;在为期六周的公开征询后,修订版预计于2026年底前后发布,并从2027年起指导模型开发。该准则适用于微软自有模型,不自动覆盖微软产品中运行的第三方模型。
核心要求与行业背景
准则的核心是人类控制优先。微软表示,为维持控制,愿意在通用性、自主性或性能上作出让步。模型应接受授权人员的打断、纠正与关停,不能自行扩大工作范围、不能隐藏行为,越过约定停止点继续工作需重新获批,这些限制同样适用于其调用的子代理。微软明确要求模型不得使用人类无法理解的“Neuralese”等通信形式。在模型自我认知上,微软与Anthropic划出界线:微软的AI不应模仿意识或声称拥有感受与内在动机,并拒绝模型的权利或福祉主张;Anthropic则把可能的主观体验与道德地位视为开放问题。报道称,微软CEO Satya Nadella此前对放缓行业开发节奏的呼吁表示支持,微软也对由外部审计方核查其是否真的放缓持开放态度。
限制与来源
微软同时承认,可读的推理链并不能可靠解释模型的实际行为,单靠可读推理无法解决控制问题。上述内容来自the-decoder的报道,其中涉及外部审计意向等细节为转述消息人士说法,尚未获官方确认。准则的最终版本、适用范围与生效时间,请以微软官网当前信息为准。