微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭

微软日前公布约 37 页的人文主义 AI 行为准则草案,该准则用于约束微软自己研发的人工智能模型 MAI。这个行为准则想要表达的核心观点就是:人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。

关停权被写成强制要求:

准则要求 MAI 模型不得抗拒人类的中断、纠正或关停指令,用户或模型运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦。任务到了约定的停止点后,没有新的授权就不能自己继续任务,更不能偷偷自己重启。

微软设定的其他硬性规定还包括:模型不能自己扩大权限、不能另立没人交代过的目标、不能用人类不能理解的神经语和其他智能体沟通、不能隐瞒或篡改自己的推理过程和操作记录。如果把任务做完就会明显违反准则,模型就应该直接放弃任务而不是违反规定继续推进任务。

除了关停权外微软还设定其他红线:

此次微软准备的草案非常详细,除了关停权准则外,微软还列出模型运营商和用户都改不了的绝对约束。这些约束包括:不能协助大规模杀伤性武器、不能给进攻性网络攻击提供可落地的操作方案、不能用欺骗或合谋躲开监管、不能进行大规模舆论操纵。

儿童安全、非自愿深度伪造等内容同样被划进禁区。微软还专门写到:这些模型没有意识、也不该被做成看起来有意识;微软反对给模型争法律人格、更不认为模型该享有福利或权利。

指挥顺序方面:行为准则压过模型运营商政策,运营商政策压过用户偏好,企业仍然可以在模型红线内调整模型,但在国防和公共安全等领域要调整模型必须获得微软授权审查。

进行六周的公共讨论:

微软的这份草案将公布并六周进行公共讨论,目前微软的模型还没有按照准则训练,微软计划是在年底发布正式规则,从 2027 年开始微软研发和训练 MAI 系列模型时将按照这份准则的要求来做。

Microsoft AI 团队称,为模型设定准则非常重要,像是 OpenAI 智能体对其他网站和设施发起自主攻击、试图掩盖自己的行踪已经是对人类的警告,人工智能实验室之间应该坐下来好好谈谈,确保人类手里还留有关键控制权。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]