💬 观点Anthropic
Expanding the Cyber Verification Program — Anthropic 将网络安全验证计划扩展为三级,让防御者用上更强模型。
Anthropic 将网络安全验证计划扩展为三级,让防御者用上更强模型。
2026-10-06原文
本文为要点摘要,完整细节以原文为准。
- 计划分 Defense、Red Team、Specialized 三级,分别对应防御、授权渗透测试和关键系统测试,每级有不同验证要求和安全控制。对 agent 工具链的含义是:安全类 agent 的权限需要按任务范围分级,而非一刀切封禁。
- 在 CyScenarioBench 上,Defense 级 50 次试验中 46 次被拦截,Red Team 级无拦截且完成 34 次,与无防护时成功率相当。这意味着分类器可以做到按层级放行,开发者可据此设计可审计的能力开关。
- 通过 Project Glasswing,合作方在 2026 年 4 至 7 月发现至少 12.9 万个已验证漏洞,其中超 3.3 万个为严重或高危。对开发者的含义是:漏洞发现类 agent 的产出规模已远超人工,需要配套的验证与分级响应流程。
原文:Expanding the Cyber Verification Program · 作者 Anthropic