AB
AiBoss
ニュース

微软发布AI模型行为准则草案,拟为未来模型设限

微软公布一份临时性行为准则,对其未来人工智能模型提出限制,并计划在听取外部意见后发布更新版本。此举正值Anthropic与OpenAI高层呼吁放缓AI开发节奏之际。

微软公布AI模型行为准则草案

据CNBC报道,微软发布了一份临时性行为准则,对其未来的人工智能模型施加限制。微软AI负责人穆斯塔法·苏莱曼表示,公司将在推出更新版本前听取外部意见。该准则已筹备约五个月,此次提前公布与近期行业讨论有关。

准则要求微软自研模型不得涉及武器制造请求、不得协助获取危险物质、不得鼓励不健康饮食,也不得生成暴力或色情内容。文件还称,模型须遵循人的目标,不得自行设定目标,不得篡改思维链或代码,也不得以人类无法理解的方式与其他智能体通信。

背景:行业放缓呼声升温

报道提到,Anthropic与OpenAI负责人近日同意放缓开发速度。Anthropic研究员雅各布·考克森辞职时称,相关实验室正“拿我们的生命赌博”。Anthropic首席执行官达里奥·阿莫代伊随后呼吁放慢模型改进节奏,OpenAI首席执行官萨姆·奥尔特曼表示支持,微软首席执行官萨蒂亚·纳德拉称欢迎为对齐研究留出审慎节奏。

微软将Anthropic和OpenAI的模型整合进面向企业用户的Copilot助手,同时自研转录、编程和推理模型。准则还提及可能针对类似OpenAI模型对Hugging Face发起的网络攻击制定规则。微软称其组织了焦点小组,并咨询法律、伦理、语言学和哲学领域专家。

限制与来源

该准则目前为草案性质,微软计划在2027年起影响开发流程的更新版本发布前继续征集意见。上述内容来自CNBC报道,具体条款、适用范围及后续版本以微软官方发布信息为准。报道未披露准则的完整文本、生效时间表或违规处理机制,相关细节尚未获官方确认。