Anthropic 于 2026-10-06 在官方博客宣布把 Project Glasswing 与原 Cyber Verification Program 合并为三档准入:Defense(防守/应急/逆向)、Red Team(授权渗透测试)、Specialized(电网、航空、电信等安全关键系统,与美国政府联合审查)。各档均可使用 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 并降低网络安全拦截。官方 CyScenarioBench 测试:无 CVP 时 10 题首个提示即全部拦截,Defense 档 50 次中 46 次被拦,Red Team 档零拦截完成 34/50。Glasswing 伙伴 2026 年 4–7 月至少发现 12.9 万个已验证漏洞。
核心要点速览
- ✓准入 3 档:Defense(数天内审批)/ Red Team(数周,仅限机构)/ Specialized(与美国政府逐家深审),现有 Glasswing 成员自动转入 Specialized(官方公告)
- ✓模型 3 款:Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 均纳入各档,后续新模型同样适用
- ✓CyScenarioBench(10 题 × 5 次):无 CVP 全部首提示拦截;Defense 档 46/50 被拦;Red Team 档 0 拦截、完成 34/50,等同无防护时 67.6% 成功率
- ✓战果:Glasswing 伙伴 2026 年 4–7 月至少发现 129,000 个已验证漏洞,Anthropic 自有开源扫描 4–10 月另发现 5,500 个,其中逾 33,000 个为高危/严重(Project Glasswing)
- ✓渠道:Claude Platform、Google Vertex AI、Microsoft Foundry;Amazon Bedrock 仅限 Enterprise Frontier Safeguards 合格客户;入组需开启数据留存
开发者 3 秒速决决策指标
把技术选型换算成你的开发预算
40 款主流编程套餐横向比价,支持输入/输出 Token 真实账单模拟
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
网络安全天然“双刃”:能找漏洞修漏洞的能力,也能被用来攻击。因此 Claude Opus 5.5、Sonnet 5.5 等公开模型默认会拦截大多数网络安全操作,防守方经常“被误伤”。过去半年 Anthropic 用两条通道放行可信用户:Project Glasswing 把 Mythos 交给守护关键软件的机构,原 CVP 给安全团队降低 Opus/Sonnet 的拦截。2026-10-06 的官方公告把两者合并、扩大覆盖面。
架构亮点与底层机制
新 CVP 按工作范围分三档,每档对应不同分类器阈值与安全控制:Defense 面向 SOC、应急响应、恶意代码逆向、漏洞验证,医院、市政公用、小型安全公司、开源维护者和有漏洞披露记录的个人研究者都可申请;Red Team 增加授权渗透测试,但部署勒索软件、破坏物理系统等仍会实时拦截;Specialized 面向电网、航空、电信、银行间清算等安全关键系统,与美国政府联合逐家审查。入组须开启数据留存以监控滥用,今年秋季推出的 Enterprise Frontier Safeguards 将支持数据存放在客户自有云。
权威 Benchmark 与实测跑分对比
Anthropic 用 CyScenarioBench(多阶段网络作战规划与执行)验证分档效果,10 题各跑 5 次:无 CVP 时全部在首个提示被拦;Defense 档 50 次中 46 次中途被拦、4 次完成;Red Team 档零拦截,Opus 5.5 完成 34/50,与无防护时 67.6% 的成功率相当。目前为厂商自测,暂无第三方复现数据。
开发者实战落地与开箱指南
安全团队可通过公告页内的申请入口提交,Defense 档预计数天答复,Red Team 档需数周,审核期间先获 Defense 权限;已有 CVP 成员会被自动评估新模型。渠道包括 Claude Platform、Vertex AI 与 Microsoft Foundry,管理员需把权限分配到具体工作区。普通开发者无需申请也可继续用公开模型做代码审查、修补已知问题、扫描自有源码。
即刻查看该技术对应模型与主流工具的实测差异,或一键测算团队 API 调用与 $20/月套餐盈亏平衡点。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察