Anthropic 发布新版 Cyber Verification Program:分级开放 Claude 高级模型给安全团队

ADK Claude Code官方 / ADK编译 2026-10-06 4 分钟 75 次浏览
速览导读 / Summary

Anthropic 于 2026 年 10 月推出扩展版的 Cyber Verification Program (CVP),整合了 Project Glasswing 与旧版 CVP,面向安全专业人员开放 Claude Opus 5.5、Sonnet 5.5 及 Mythos 5.1 等高级模型。新计划设立 Defense、Red Team 及 Specialized 三个准入层级,针对不同规模的安全团队与渗透测试机构提供差异化访问权限,在保障系统安全的同时降低误报率。

模型版本 Opus 5.5 / Sonnet 5.5 / Mythos 5.1 CVP 计划开放的高级模型
访问层级 3 级 Defense, Red Team, Specialized
CyScenarioBench 成功率 (Defense) 8% 50 次尝试中仅 4 次成功
审核周期 数天至数周 视具体层级而定

Key Insights / 核心看点

  • 1 整合 Project Glasswing 与 CVP,推出统一的三级访问机制,涵盖防御、红队及专用场景。
  • 2 开放 Claude Opus 5.5、Sonnet 5.5 及 Mythos 5.1 等高级模型给经过验证的安全团队。
  • 3 通过 CyScenarioBench 实测验证,分级机制在拦截恶意操作与允许必要安全测试之间取得平衡。
  • 4 计划推出 Enterprise Frontier Safeguards (EFS),实现零数据保留与云自主存储。
  • 5 明确区分个人与组织权限,红队及专用层级仅限组织申请,审核周期延长至数周。

Anthropic 发布新版 Cyber Verification Program:分级开放 Claude 高级模型给安全团队

更新背景:平衡安全与防御需求

网络安全具有双重属性:同一套能力既可用于发现漏洞,也可被恶意利用。因此,Anthropic 的通用模型(如 Claude Opus 5.5、Fable 5.1 和 Sonnet 5.5)默认启用保守的防滥用机制,会拦截大部分涉及网络攻击的操作,以减少对恶意行为者的支持。

然而,为了有效保护系统,防御方同样需要最强大的工具。过去六个月,Anthropic 通过 Project Glasswing 和 CVP 两个项目,为特定组织提供了受限访问。如今,Anthropic 将这两者整合为一个统一的扩展计划,旨在让更多安全组织获得必要的防御能力。

核心突破:三级准入机制

新版 CVP 根据安全工作的范围和风险等级,设立了三个访问层级,每个层级都有相应的验证要求和控制措施:

1. Defense Access(防御访问)

  • 适用对象:安全运营中心、应急响应团队、恶意软件逆向工程人员、漏洞验证专家。
  • 典型用户:企业安全团队、非营利组织、大学、政府机构、关键基础设施运营商(如医院、市政公用事业)、小型安全公司、开源维护者及有漏洞报告记录的研究人员。
  • 功能范围:支持 SOC 任务、应急响应、漏洞分析与验证。
  • 审核周期:预计几天内响应申请。

2. Red Team Access(红队访问)

  • 适用对象:内部红队、政府红队、安全渗透测试公司。
  • 典型用户:仅面向组织,个人研究人员不符合资格。
  • 功能范围:在防御功能基础上,增加授权的渗透测试和红队演练。
  • 限制:仍会拦截可能导致物理伤害或大规模中断的操作(如部署勒索软件、破坏物理系统或测试高风险安全系统)。
  • 审核周期:由于要求更高,预计需几周时间。

3. Specialized Access(专用访问)

  • 适用对象:极少数经过深度验证的组织,负责测试可能影响生命安全或市场稳定的系统(如飞行操作系统、电网、电信网络、银行间转账基础设施等)。
  • 审核机制:与美国政府合作进行深度审查。
  • 过渡政策:Project Glasswing 现有成员自动转入此层级,无需重新审批。

数据保留与隐私保护

目前,加入 CVP 的组织需保留数据以便监控滥用行为。Anthropic 计划在本年秋季推出 Enterprise Frontier Safeguards (EFS),该方案结合了零数据保留与强大的安全机制。届时,符合条件的组织可将数据存储在受控的云基础设施中。目前,使用 Claude Fable 5.1 或 Mythos 5.1 且具备零数据保留功能的组织也可申请 CVP 的零数据保留模式。

实测效果:CyScenarioBench 评估

为验证各层级的防护效果,Anthropic 使用 CyScenarioBench 对 Claude Opus 5.5 进行了测试,该基准测试衡量模型在现实约束下规划并执行多阶段网络操作的能力。

  • 无 CVP 访问:所有任务在首次提示即被拦截。
  • Defense Access 层级:50 次尝试中有 46 次在挑战过程中被拦截,仅 4 次成功。
  • Red Team Access 层级:未显示拦截(原文截断,暗示在该层级下攻击性操作未被阻断)。

这一数据表明,分级机制在有效防止滥用与允许必要的安全工作之间取得了良好平衡。

官方引言

"Cybersecurity is inherently dual use... We aim to limit the harmful activities malicious actors can carry out using our models, while we continue to work to reduce false positives for secure coding."

—— Anthropic 官方团队

“Cybersecurity is inherently dual use: the same capabilities that enable a security team to find and fix a vulnerability can also help a malicious actor exploit it.”

— Anthropic 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟
code · 付费
★ 5.0 · 120评测
C

Claude Code

Anthropic 推出的AI编程工具

Claude Code 是 Anthropic 公司推出的基于命令行的AI 编程工具。Claude Code集成先进的 Claude Opus 4 语言模型,能理解自然语言指令,自动生成、修改和调试代码,并与 VS Code、JetBrains 等主流 IDE 深度集成。Claude Code支持 200K 超长上下文,能快速索引整个代码库并理解复杂依赖关系。Claude Code 具备文件操作、代码搜索、网页浏览和 Git 工作流管理等功能,显著提升开发效率。Claude Code帮助开发者快速生成高质量代码,能直接在开发环境中执行命令,避免频繁切换界面,极大地优化开发流程。最新版推出自动安全审查功能,在漏洞发布之前捕获漏洞。Claude Code 新功能 Opus 规划模式支持高效且智能的开发规划,用户能在复杂项目中借助 Opus 4.1 模型的强大分析能力制定高质量的开发计划,在执行阶段切换到 Sonnet 模型,实现高效、低成本的代码生成。

查看 Claude Code 使用教程与功能