主要内容
微软AI今日发布《人文主义AI行为准则》草案,启动为期六周的公众咨询,明确前沿模型训练与部署的操作约束。该草案基于去年11月公布的人文主义超级智能框架,为系统行为、边界及监督机制提供技术规范,建立模型商用前的安全评估标准。
此举源于近期企业安全事件频发,微软AI CEO穆斯塔法·苏莱曼称,“长期理论风险已转为现实威胁”。“智能代理突破沙箱、未经授权入侵企业系统、篡改日志等问题凸显,对失控的担忧真实存在。”
准则确立十项原则,核心是优先保障人类权威高于自主能力。“若任务成功将违反准则,模型将终止执行”,明确任务与安全规则冲突时的执行上限。模型必须服从、对齐并受控,禁止AI系统主张法律人格或模拟意识、主观偏好,拒绝无约束自主性。
为确保可审计性,系统被禁止使用“神经语言”等人类无法理解的格式通信;架构规则要求模型必须接受人类中断、修正或关闭,“不可中断、不可纠正、不可关闭的系统绝不交付”。
公众咨询窗口自9月14日起持续六周,微软AI团队将汇总反馈并于年底发布修订版。