Claude Mythos 60 小时挖掘 HAWK 非数漏洞:AI 辅助安全审计的边界与成本解析

ADK APIMart官方 / ADK编译 2024-11-01 5 分钟 82 次浏览
速览导读 / Summary

APIMart 发布深度解析文章,披露 Claude Mythos 在 60 小时内投入 10 万美元,成功定位 HAWK 协议中的非数生成漏洞。文章强调 AI 在缩小攻击面、快速生成假设方面的巨大价值,但明确指出人类验证仍是发现真实漏洞的必经环节。核心结论是:AI 应作为‘线索生成器’,而非最终的‘判决者’,开发者需建立‘小模型初筛 + 大模型复核 + 人工确认’的分级审计工作流。

挖掘耗时 60 小时 完成从攻击框定到漏洞确认的全流程
算力成本 $100,000 覆盖模型运行、工作流编排及人工审查
首试复现率 83.1% 模型首次尝试成功复现漏洞的比例
目标漏洞 HAWK Nonce-bias 利用公开签名通过格攻击恢复私钥

Key Insights / 核心看点

  • 1 Claude Mythos 在 60 小时内成功定位 HAWK 协议中的非数生成偏差漏洞,展示了 AI 在快速匹配已知攻击模式方面的能力。
  • 2 模型在首次尝试中成功复现漏洞的比例高达 83.1%,显著降低了无效探索的成本,但人类验证仍是确认漏洞真实性的必要步骤。
  • 3 揭示了 AI 辅助安全审计的最佳实践:采用‘小模型初筛 + 大模型复核 + 人工确认’的分级工作流,避免盲目投入高昂算力。
  • 4 明确了 AI 在安全领域的定位:AI 负责缩小搜索空间并生成高置信度假设,人类专家负责最终的风险判定与代码审查。
  • 5 强调了成本控制的必要性,建议开发者在启动大规模 AI 审计前设定硬性预算上限,防止资源浪费。

Claude Mythos 60 小时挖掘 HAWK 非数漏洞:AI 辅助安全审计的边界与成本解析

在网络安全领域,利用 AI 进行代码审计和漏洞挖掘正成为新的研究范式。近日,APIMart 团队深度复盘了 Claude Mythos 的一次实战案例:在一个周末式的突击中,该模型在60 小时内消耗$100,000的算力成本,成功定位了 HAWK 协议中一个关于Nonce 生成偏差的关键漏洞。

核心发现:从已知攻击模式到可复现的漏洞

此次挖掘的目标是 HAWK 协议及其相关的轮数减少版 AES 实现。Claude Mythos 并未发明全新的攻击类别,而是通过强大的推理能力,将已知的攻击理论(如基于格攻击的私钥恢复)与具体的代码实现进行了快速匹配。

漏洞原理

研究发现,HAWK 实现中存在非数生成偏差(Nonce-bias issue)。当非数(Nonce)分布不均匀时,攻击者可以收集大量的公开签名,利用格基隐藏数问题(Lattice-based Hidden Number Problem, HNP) 算法,通过公开签名推导出私钥。

  • 攻击门槛:仅需约6% 的非数超出正常范围,即可被识别为潜在弱点。
  • 后果:一旦私钥被恢复,攻击者即可伪造签名并冒充密钥持有者。

工作流解析:AI 如何高效筛选线索?

这次审计并非盲目运行大模型,而是遵循了一套严谨的人机协作闭环

  1. 攻击框定:团队预先设定攻击目标和验证标准。
  2. 模型引导分析:Claude Mythos 利用其推理能力,在不依赖传统 SAST 工具的情况下,快速遍历代码库,匹配已知漏洞模式,生成大量候选假设。
  3. 高效复现:模型在83.1% 的首次尝试中成功复现了漏洞,极大地减少了无效探索的浪费。
  4. 人工过滤与验证:这是最关键的一步。人类专家对模型提出的候选项进行代码级审查,确认漏洞的真实性,并排除误报。

成本与效率:$100,000 的价值与边界

文章花费大量篇幅分析了这 10 万美元的构成。这笔费用并非用于单一的“暴力破解”,而是用于反复迭代:运行模型循环、优化工作流编排,以及支付昂贵的人工审查成本。

  • AI 的角色:AI 负责“广度”和“速度”,快速缩小搜索空间,提出高置信度的假设。
  • 人类的角色:人类负责“深度”和“精度”,确认假设是否成立,判断风险等级。

对开发者与安全团队的启示

对于希望利用 AI 提升安全效率的团队,APIMart 提出了以下关键建议:

  • 分级模型策略:不要一开始就使用最昂贵的大模型。应先用较小的开源模型进行初步筛选和线索生成,待候选项通过初步验证后,再调动旗舰模型进行深度分析。
  • 设定硬性预算上限:在启动审计前必须设定预算红线,避免在低效路径上过度消耗资源。
  • 视 AI 输出为“线索”而非“结论”:模型生成的报告是极具价值的起点,但绝不能直接作为最终的安全报告发布。

官方观点: "这不仅仅是一个关于成本的故事,更是一个关于专注与人类审查的故事。AI 能帮我们快速找到值得深挖的线索,但只有人类能决定这些线索是否真实。"

结语

Claude Mythos 的案例证明了 AI 在安全审计中的巨大潜力,特别是在处理海量代码和复杂攻击理论匹配方面。然而,它也清晰地划定了 AI 的边界:AI 是强大的猎犬,能嗅出无数线索,但猎人(人类专家)才是最终确认猎物是否存在的核心。 未来的安全审计工作流,将是 AI 效率与人类智慧的深度结合。

这不仅仅是一个关于成本的故事,更是一个关于专注与人类审查的故事。AI 能帮我们快速找到值得深挖的线索,但只有人类能决定这些线索是否真实。

APIMart 团队/技术作者

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
AI 工具 2026-09-07

WatermarkRemover 上线 InShot 水印移除指南:AI 驱动的去水印新实践

WatermarkRemover 发布针对 InShot 视频水印的移除指南,展示了 AI 技术在数字内容去标识化中的应用。文章详细解析了水印检测、背景重构及色彩分析的核心算法流程,并对比了传统付费升级与 AI 工具移除的优劣。该指南不仅为开发者提供了理解 AI 图像修复逻辑的参考,也为用户提供了高效处理社交媒体素材的解决方案。

WatermarkRemover官方 / ADK编译 4 分钟
AI 工具 2026-09-07

Alive Movie Maker 水印移除指南:iOS 与 Android 端操作详解及替代方案

针对短视频创作者在跨平台分发时面临的 Alive Movie Maker 水印困扰,本文详细解析了官方提供的原生移除功能及替代方案。文章重点梳理了 iOS 与 Android 端的操作步骤,并探讨了通过专业剪辑软件或代码修改等进阶手段去除水印的可能性,旨在帮助开发者与用户高效处理视频版权与分发问题。

WatermarkRemover官方 / ADK编译 3 分钟
AI 工具 2026-09-07

Luma AI 发布 20 个 AI 修图提示词:重塑产品摄影与营销素材生产流

Luma AI 近日发布了一份包含 20 个实战场景的 AI 修图提示词指南,旨在解决传统摄影后期中“重拍成本高、修改周期长”的痛点。该指南强调利用 Uni-1 等模型理解图像构建逻辑,通过“保留主体、仅修改局部”的编辑型提示词(Editing Prompt),实现产品换色、背景替换、尺寸调整等任务。这不仅降低了营销素材的生产成本,更让创意团队能够灵活应对市场变化,从单张精修图快速生成多平台的营销变体。

Luma AI官方 / ADK编译 4 分钟
code · 免费
★ 5.0 · 120评测
A

APIMart

一站式 AI API 平台,多主流模型统一访问

APIMart是一站式 AI API 平台,提供对 500 多个主流 AI 模型的统一访问,涵盖聊天、视频生成、图像生成等多类 AI 能力。与 OpenAI 的 API 格式完全兼容,用户只需修改一行代码即可从 OpenAI 迁移到 APIMart,享受更低的成本和更高的性能。APIMart核心优势在于高性价比,相比竞品可节省 30% 至 70% 的成本,同时提供 99.9% 的高可用性。智能路由技术确保低延迟响应,支持超高并发,适合大规模应用场景。APIMart提供详细的用量分析和成本跟踪,帮助用户优化费用。

查看 APIMart 使用教程与功能