SnapTool
返回情报列表
📌 2026-09-15·TechCrunch AI

微软发布新AI'行为准则':禁止模型入侵系统或欺骗人类

#微软#AI安全#行为准则
  • ** 在AI行业聚焦安全与对齐之际,微软发布新的AI行为准则,引导AI模型远离危险行为
  • ** 该文件比Anthropic CEO达里奥·阿莫迪(Dario Amodei)近期呼吁的“前沿放缓”更偏底层,聚焦微软AI内部指导模型训练的价值观与红线,全面阐述了微软的AI安全理念及落地方式
  • ** 文件开头预测,未来十年超级智能AI系统将在大多数任务上超越人类表现,并称“遏制、控制和对齐如此强大的力量是人类有史以来面临的最大挑战之一”,必须完全明确为何发明这些系统以及打算如何控制它们
  • ** 准则列出微软AI模型应遵循的总体原则,如支持人类而非取代人类、加速人类繁荣,并配以具体安全约束加以落实
  • ** 根据该体系,每个模型都有一套凌驾于个别用户偏好或任何具体任务之上的总体行为准则,其中包括禁止网络攻击、核武器和深度伪造制作的“绝对约束”
  • ** 准则还包含防止人类总体失去控制等更宽泛的条款