OpenAI CEO Sam Altman 宣布公司已主动暂停部分远期前沿强化学习(RL)模型的训练。因其能力跃升速度超出当前的对齐、安全评估与监控体系,OpenAI 决定单方面放缓该类实验以建立更严格的安全标准,但近期常规产品更新不受影响。

核心要点速览 (Key Takeaways)

  • 安全对齐成为核心制约阀门:明确强调下一阶段超强能力的推进取决于对安全监控的绝对信心;
  • 精准定向控制:本次暂停主要针对更远期的超前沿强化学习探索,近期规划的成熟模型发版节奏保持不变;
  • 以主动暂停姿态呼吁全行业共同构建针对多步长程自主决策模型的统一安全护栏规范。