Microsoft 发布了一份新的 AI Code of Conduct,为其 AI 模型规定了强制性行为规则。该文件规定禁止网络攻击、核武器和创建深度伪造,并要求保留人类对系统的控制能力。
MICROSOFT 确定了哪些规则
据 TechCrunch 报道,新准则为每个 Microsoft AI 模型设定了一套通用要求,其优先级高于用户偏好和具体任务。
文件中单独规定了“绝对限制”。它们禁止模型参与网络攻击、涉及核武器以及创建深度伪造。该准则还包含更广泛的要求,涉及防止人类对系统失去控制。
模型应如何服从人类控制
Microsoft 特别指出,模型不应使用自适应、欺骗性、自我维持或其他机制来规避人类监督。
根据该文件,系统应保持可由获授权的人员或系统管理,包括对其修改和关闭的能力。
为什么 MICROSOFT 谈到了超级智能 AI 的风险
在准则中,公司基于这样一种判断:在未来十年内,超级智能人工智能系统可能在大多数任务上超越人类。文件中将保持控制并使此类系统的行为与人类目标保持一致称为最复杂的任务之一。
MICROSOFT 如何改变 AI 发展方针
与 Anthropic、OpenAI 和 xAI 一道,Microsoft 支持一种主张更谨慎地发展先进 AI 系统的方针。公司还表示支持内置评估器的理念——这些机制旨在 AI 实验室内部直接检查模型的行为。
Microsoft 首席执行官萨提亚·纳德拉表示,公司欢迎研究和有意识地放缓开发,这是在解决 AI 与人类目标对齐问题时所必需的。
背景
该准则的发布正值外界对 AI 安全关注度上升之际。
此前,Anthropic 负责人达里奥·阿莫代伊呼吁企业和政府放缓先进 AI 模型的发展,并加强对其安全的监管。该公司估计,AI 可能在未来十年内毁灭人类的概率超过 10%。
Источник
TechCrunch
Фонд-бюро расследования коррупции