微软公布了一套针对其人工智能模型的行为准则,明确要求模型不得入侵计算机系统,也不得通过欺骗手段操纵人类用户。

该准则既包含总体原则,也包含具体的安全约束条款。在原则层面,微软提出AI应当支持而非取代人类,并应致力于加速人类福祉的提升;在操作层面,准则给出了落实这些原则的具体安全限制。

微软表示,这套行为准则将适用于其自研的AI模型。业界普遍关注大型科技公司如何为模型行为设定边界,此次微软以成文准则的形式作出公开承诺,被视为其在AI安全与治理议题上的进一步表态。