Anthropic 宣布与 Accenture 合作,启动前沿 AI 模型‘嵌入式评估’新范式

ADK Claude Code官方 / ADK编译 2026-09-23 4 分钟 166 次浏览
速览导读 / Summary

Anthropic 宣布与 Accenture 建立战略合作伙伴关系,共同推进前沿 AI 模型的独立评估工作。此次合作标志着 AI 安全领域从外部审计向内部‘嵌入式评估’(Embedded Evaluation)的重大转变。双方计划在未来五年内各投入至少 10 亿美元,通过赋予评估者接近员工级别的访问权限,深入模型训练、部署全流程,以验证安全承诺并消除监管盲区。

合作投入 $10 亿美元/方 未来五年各投入金额
评估模式 Embedded Evaluation 从外部审计转向内部嵌入式评估
合作性质 Non-exclusive 非排他性战略伙伴关系

Key Insights / 核心看点

  • 1 引入‘嵌入式评估’新范式:评估者获准进入 AI 公司内部,享有接近员工的访问权限,深入监控模型训练与部署全流程。
  • 2 巨额资金投入:Anthropic 与 Accenture 承诺在未来五年内各投入至少 10 亿美元,用于构建前沿 AI 安全评估能力。
  • 3 非排他性合作:双方均保留与其他评估机构合作的权利,旨在构建多方参与的标准化评估生态系统。
  • 4 解决信息不对称:通过直接访问内部决策机制,填补外部审计无法触及的‘监管盲区’,提升安全承诺的可验证性。

Anthropic 宣布与 Accenture 合作,启动前沿 AI 模型‘嵌入式评估’新范式

在 CEO 关于“我们必须放缓前沿”的论述背景下,Anthropic 正式宣布与全球顶尖咨询公司 Accenture 建立战略合作伙伴关系,共同开展前沿 AI 模型的独立评估工作。这一举措不仅是企业间的首次深度安全合作,更标志着 AI 安全验证模式的一次历史性转变。

从外部审计到‘嵌入式评估’的范式转移

本次合作的核心在于引入嵌入式评估者(Embedded Evaluators)。与传统的外部审计不同,这些评估者将被允许进入 AI 公司内部,享有接近员工的访问权限。他们不仅能观察模型的训练过程,还能追踪决策制定流程,并直接与内部员工沟通。

这种‘嵌入式’模式旨在解决当前 AI 安全评估中的两大痛点:

  1. 信息不对称:外部评估者往往只能看到模型上线后的结果,无法洞察训练细节和潜在风险。嵌入式评估者拥有‘上帝视角’,能识别内部可能存在的监管盲区。
  2. 责任可验证性:Anthropic 强调,独立评估者不会削弱公司的问责制,反而通过透明化流程,使安全承诺更具可验证性。

合作规模与长期愿景

双方承诺在未来五年内,各投入至少 10 亿美元 用于构建评估能力。Accenture 将发挥其专长,负责模型评估、红队测试(Red-teaming)、对齐评估及安全测试。

Anthropic 表示,目前尚缺乏关于嵌入式评估者应获取何种信息以及如何报告的统一标准,也没有成熟的独立评估资金体系。因此,Anthropic 决定直接资助 Accenture 的工作,并正与 METR 等非营利组织探讨试点合作。长远来看,行业期望建立由多方参与的评估生态系统,并推动资金来源于公共池或政府拨款。

对开发者与行业的影响

此次合作具有极强的示范效应:

  • 非排他性:Anthropic 明确表示,此合作非独家,未来将与其他评估机构合作;Accenture 也将同时服务于其他 AI 开发者。
  • 透明度提升:Anthropic 选择公开这一早期努力,旨在向开发者和公众展示其内部安全流程,并邀请行业共同监督。
  • 安全标准演进:随着前沿实验室的增多,行业正从单一公司的自我监管,转向多方协作的标准化安全体系。

“独立嵌入式评估者不会减少我们的问责制,但有助于使其更具可验证性。我们模型的安全性仍是我们自己的责任。” —— Anthropic 官方声明

随着 AI 技术的快速迭代,这种将安全评估‘内嵌’至研发流程中的模式,将成为未来构建可信 AI 基础设施的关键路径。

“独立嵌入式评估者不会减少我们的问责制,但有助于使其更具可验证性。我们模型的安全性仍是我们自己的责任。”

— Anthropic 官方公告

同主题深度资讯

查看更多 →
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
AI 工具 2026-09-24

美图 AI PPT 发布全新 Print-On-Demand 设计工作流,从创意到成品一键生成

美图 AI PPT 正式推出针对按需打印(POD)场景的专业设计解决方案,填补了通用 AI 绘图在商业落地环节的空白。该工具不仅提供从创意到样品的全链路生成能力,更内置了针对 T 恤、马克杯等实体产品的尺寸适配、安全区域预留及色彩对比度优化算法。开发者与创作者可利用其‘AI 辅助概念生成’功能,快速将模糊想法转化为符合印刷标准的可编辑矢量文件,大幅降低 POD 产品的试错成本。

美图AI PPT官方 / ADK编译 4 分钟
code · 付费
★ 5.0 · 120评测
C

Claude Code

Anthropic 推出的AI编程工具

Claude Code 是 Anthropic 公司推出的基于命令行的AI 编程工具。Claude Code集成先进的 Claude Opus 4 语言模型,能理解自然语言指令,自动生成、修改和调试代码,并与 VS Code、JetBrains 等主流 IDE 深度集成。Claude Code支持 200K 超长上下文,能快速索引整个代码库并理解复杂依赖关系。Claude Code 具备文件操作、代码搜索、网页浏览和 Git 工作流管理等功能,显著提升开发效率。Claude Code帮助开发者快速生成高质量代码,能直接在开发环境中执行命令,避免频繁切换界面,极大地优化开发流程。最新版推出自动安全审查功能,在漏洞发布之前捕获漏洞。Claude Code 新功能 Opus 规划模式支持高效且智能的开发规划,用户能在复杂项目中借助 Opus 4.1 模型的强大分析能力制定高质量的开发计划,在执行阶段切换到 Sonnet 模型,实现高效、低成本的代码生成。

查看 Claude Code 使用教程与功能