AI Information Stream

安全治理 - AI 资讯

20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。

AIADK Insight

Anthropic 发布 Claude Code 负责任扩展政策 2.0:引入能力阈值与分级安全标准

Anthropic 宣布更新其负责任扩展政策(RSP),旨在应对前沿 AI 系统带来的潜在灾难性风险。新政策引入了基于“能力阈值”的分级安全框架(ASL 标准),明确了对自主研发及 CBRN 武器辅助等高风险场景的严格管控措施。此次更新不仅细化了安全评估流程,还强调了内部治理与外部专家反馈的协同机制,标志着 AI 安全治理从通用原则向精细化、场景化管控的转型。

2024-10-15 阅读全文