OpenAI 宣布即将发布的 Astra 在其 Preparedness Framework 下首次达到网络安全「Critical」阈值,并公开评估方法与配套安全护栏。公司强调将让更强模型安全、广泛可用,同时把先进网络能力优先交给防御方,标志着前沿模型发布已从纯能力竞赛转向能力与安全同步披露。
核心要点速览 (Key Takeaways)
- ✓Astra 是 OpenAI 首个在网络安全维度达到 Critical 级别的模型
- ✓发布节奏被安全评估与护栏建设明确卡住,但公司承诺尽快广泛可用
- ✓前沿模型发布叙事已转向「先证明可控,再谈规格」
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察