OpenAI 宣布即将发布的 Astra 在其 Preparedness Framework 下首次达到网络安全「Critical」阈值,并公开评估方法与配套安全护栏。公司强调将让更强模型安全、广泛可用,同时把先进网络能力优先交给防御方,标志着前沿模型发布已从纯能力竞赛转向能力与安全同步披露。

核心要点速览 (Key Takeaways)

  • Astra 是 OpenAI 首个在网络安全维度达到 Critical 级别的模型
  • 发布节奏被安全评估与护栏建设明确卡住,但公司承诺尽快广泛可用
  • 前沿模型发布叙事已转向「先证明可控,再谈规格」
ADSponsored