Anthropic 发布新版 Cyber Verification Program:分级开放 Claude 高级模型给安全团队
更新背景:平衡安全与防御需求
网络安全具有双重属性:同一套能力既可用于发现漏洞,也可被恶意利用。因此,Anthropic 的通用模型(如 Claude Opus 5.5、Fable 5.1 和 Sonnet 5.5)默认启用保守的防滥用机制,会拦截大部分涉及网络攻击的操作,以减少对恶意行为者的支持。
然而,为了有效保护系统,防御方同样需要最强大的工具。过去六个月,Anthropic 通过 Project Glasswing 和 CVP 两个项目,为特定组织提供了受限访问。如今,Anthropic 将这两者整合为一个统一的扩展计划,旨在让更多安全组织获得必要的防御能力。
核心突破:三级准入机制
新版 CVP 根据安全工作的范围和风险等级,设立了三个访问层级,每个层级都有相应的验证要求和控制措施:
1. Defense Access(防御访问)
- 适用对象:安全运营中心、应急响应团队、恶意软件逆向工程人员、漏洞验证专家。
- 典型用户:企业安全团队、非营利组织、大学、政府机构、关键基础设施运营商(如医院、市政公用事业)、小型安全公司、开源维护者及有漏洞报告记录的研究人员。
- 功能范围:支持 SOC 任务、应急响应、漏洞分析与验证。
- 审核周期:预计几天内响应申请。
2. Red Team Access(红队访问)
- 适用对象:内部红队、政府红队、安全渗透测试公司。
- 典型用户:仅面向组织,个人研究人员不符合资格。
- 功能范围:在防御功能基础上,增加授权的渗透测试和红队演练。
- 限制:仍会拦截可能导致物理伤害或大规模中断的操作(如部署勒索软件、破坏物理系统或测试高风险安全系统)。
- 审核周期:由于要求更高,预计需几周时间。
3. Specialized Access(专用访问)
- 适用对象:极少数经过深度验证的组织,负责测试可能影响生命安全或市场稳定的系统(如飞行操作系统、电网、电信网络、银行间转账基础设施等)。
- 审核机制:与美国政府合作进行深度审查。
- 过渡政策:Project Glasswing 现有成员自动转入此层级,无需重新审批。
数据保留与隐私保护
目前,加入 CVP 的组织需保留数据以便监控滥用行为。Anthropic 计划在本年秋季推出 Enterprise Frontier Safeguards (EFS),该方案结合了零数据保留与强大的安全机制。届时,符合条件的组织可将数据存储在受控的云基础设施中。目前,使用 Claude Fable 5.1 或 Mythos 5.1 且具备零数据保留功能的组织也可申请 CVP 的零数据保留模式。
实测效果:CyScenarioBench 评估
为验证各层级的防护效果,Anthropic 使用 CyScenarioBench 对 Claude Opus 5.5 进行了测试,该基准测试衡量模型在现实约束下规划并执行多阶段网络操作的能力。
- 无 CVP 访问:所有任务在首次提示即被拦截。
- Defense Access 层级:50 次尝试中有 46 次在挑战过程中被拦截,仅 4 次成功。
- Red Team Access 层级:未显示拦截(原文截断,暗示在该层级下攻击性操作未被阻断)。
这一数据表明,分级机制在有效防止滥用与允许必要的安全工作之间取得了良好平衡。
官方引言
"Cybersecurity is inherently dual use... We aim to limit the harmful activities malicious actors can carry out using our models, while we continue to work to reduce false positives for secure coding."
—— Anthropic 官方团队