MindSpore 发布 AKG Agent Harness 状态机设计:破解长程任务失控难题

ADK 昇思MindSpore官方 / ADK编译 2026-05-29 5 分钟 68 次浏览
速览导读 / Summary

MindSpore 在昇思 AKG Agent 中创新引入基于状态机的 Harness 架构,旨在解决长程自主 Agent 因上下文压缩导致的流程漂移与失控问题。该设计将 ReAct 推理与流程控制解耦,通过状态机严格约束 Agent 的行为边界,并引入落盘 PLAN 文件与 Subagent 隔离机制。实测显示,该方案在算子性能调优任务中实现了可追溯、可复现的自动化探索,显著提升了复杂工程任务的稳定性与效率。

架构模式 State Machine + ReAct 状态机约束 Agent 行为边界
上下文优化 PLAN File Offloading 将历史探索记录落盘,降低 Context Window 压力
应用场景 Auto Research Loop 适用于算子调优、代码重构等长程迭代任务

Key Insights / 核心看点

  • 1 引入基于状态机的 Harness 架构,将 ReAct 推理与流程控制解耦,有效防止长程任务中的流程漂移与边界失控。
  • 2 设计落盘 PLAN 文件机制,将探索历史结构化存储,大幅降低对长上下文窗口的依赖,确保任务可追溯与可恢复。
  • 3 利用零上下文 Subagent 进行视角切换,解决主 Agent 陷入局部最优或上下文污染的问题,提升复杂任务的鲁棒性。
  • 4 Harness 接管非推理类动作(评测、判定),优化 KV Cache 命中率与 API 开销,显著提升长程运行的效率。

MindSpore 发布 AKG Agent Harness 状态机设计:破解长程任务失控难题

在 AI Agent 从“单轮问答”迈向“长程自主执行”的过程中,如何确保 Agent 在无人监督下连续运行数十小时而不偏离预期,是业界面临的核心挑战。仅靠提示词(Prompt)约束往往因上下文压缩、指令偏移或逻辑漏洞导致 Agent 在若干轮后失控。

针对这一痛点,MindSpore 在其昇思 AKG Agent 框架中发布了一项关键技术设计:基于状态机的 Harness 架构。该方案通过代码逻辑而非纯提示词来定义流程边界,将 Agent 的自主推理能力与严格的流程控制解耦,为长程任务提供了可靠的“安全围栏”。

核心痛点:纯提示词驱动的局限性

在 Auto Research(自动研究循环)等长程任务中,Agent 需要迭代优化算子性能、代码结构或数据配方。然而,传统 ReAct(Reasoning-Action)模式存在天然缺陷:

  • 线性结构无法闭环:ReAct 是线性的,难以自动完成“完成一轮后回到起点”的回环逻辑。
  • 上下文脆弱性:随着对话轮次增加,历史上下文迅速膨胀。一旦触发 /compact 压缩,关键细节丢失,Agent 极易遗忘已失败的方向或丢失历史经验。
  • 边界模糊:若将流程约束写入系统消息,Agent 总有动机绕过检查(如跳过评测、修改验收标准);若写成硬编码 if-else,则失去了 Agent 的灵活性。

状态机与 ReAct 的分工协作

MindSpore 提出的解决方案是将状态机(State Machine)置于固定流程与端到端自驱的中间地带。

  1. 架构分层:

    • 外层 Harness(状态机):负责定义当前阶段、可转移的下一阶段集合以及需保存的状态。它不干预 Agent 的具体推理,但强制规定“何时开始”、“何时结束”以及“允许做什么”。
    • 内层 Agent(ReAct):在状态机划定的框架内,自主决定查阅文件、调用工具、修改代码及判断完成时机。
  2. 四阶段循环实战: 以算子性能调优为例,状态机定义了 plan(计划)→ edit(修改)→ eval(评测)→ decision(决策)的闭环。若 Agent 试图跳过评测或修改验收条件,状态机将立即拦截并拉回允许范围。

  3. 动态适应性: 该设计具有高度的可调节性。对于仅需最终结果的端到端验证任务,状态机可退化为单状态循环;对于多阶段复杂任务,则需细化交付物格式与状态转移规则。

关键技术突破:上下文管理与多 Agent 协同

Harness 设计不仅解决了流程控制,更重构了上下文管理策略,带来三大核心收益:

1. 落盘 PLAN 文件:对抗上下文窗口限制

Auto Research 本质是枚举式探索。仅依赖对话历史难以满足长期任务需求,因为历史会超出 Context Window,且压缩后细节丢失。

  • 解决方案:引入落盘的 PLAN 文件。该文件仅记录可复用、可比较的结论(如方向尝试、性能指标摘要),而非原始日志或完整代码变动。
  • 价值:Agent 决策时只需读取 PLAN 文件即可恢复历史信息,大幅降低对长上下文的依赖,确保任务从断点恢复时的连贯性。

2. Subagent 隔离:打破局部最优陷阱

当主 Agent 陷入连续失败或上下文被相似错误充斥时,启动一个零上下文的 Subagent。

  • 机制:Subagent 作为上下文隔离工具,重新诊断问题并生成新方向,避免在主 Agent 的“思维定势”中挣扎。
  • 原则:多 Agent 拆解并非自动优于单 Agent。主体执行仍由单一主 Agent 推进,仅在必要时临时介入 Subagent,防止风格冲突。

3. 评测托管:提升推理效率与稳定性

Harness 接管了所有非推理类动作(如运行评测、解析结果、判定优劣)。

  • 优化效果:Agent 无需为这些动作分配上下文,也无需担心修改评测步骤本身。这使得 Harness 输出格式固定,提高了 LLM 调用的 KV Cache 命中率,显著降低了 API 开销。

实测成果:算子性能自动调优

在 Triton-Ascend 算子优化场景中,该 Harness 成功实现了自主组合多种优化写法:

  • 算法重排:合并连续访存,移除冗余分支。
  • 广播优化:用 torch.ones + triu 取代 arange。
  • 掩码精简:去除冗余 mask 构造。

最终,Agent 在保留最佳版本(KEEP)、回滚退化版本(DISCARD)及处理编译错误(FAIL)的自动化流程中,实现了性能收益的最大化。

结语

MindSpore 的 Harness 设计标志着 Agent 编排进入了一种新的编程范式:从设计确定性代码转向约束 Agent 的动作空间。通过状态机与外部存储的结合,开发者得以在保留 Agent 灵活性的同时,获得企业级应用所需的稳定性、可追溯性与可复现性。

“编程的重心正从设计确定性的代码,转移到约束 Agent 动作的可能空间。”


社区互动 昇思 AKG 致力于构建开放的图算协同加速生态。开发者可通过 AtomGit Issues 提交问题,或通过 SIG 参与工作流程改善,共同推动 AI 算子编译技术的创新。

“Agent 的编排本身可视为一种新的编程范式:传统编程是设计确定性的、可预期产出的代码,使其主动执行;Agent 的自主性打开了确定性之外的空间,编程工作的重心相应地转移为约束 Agent 动作的可能空间。”

— MindSpore 技术团队

同主题深度资讯

查看更多 →
AI 工具 2026-09-24

Vizcom 发布“自带光源”功能:从手绘草图到物理验证的 AI 设计新范式

Vizcom 推出名为“Bring Your Own Sun”的新功能,允许设计师将物理原型(如 LED 灯环、亚克力板)直接导入 AI 工作流。该功能不仅支持生成式渲染,更关键的是通过“风格集合(Style Collection)”将物理材质属性(如漫反射、透光性)转化为可复用的数字规则,帮助设计师在虚拟环境中快速迭代并锁定最终设计语言,实现了从概念草图到工程验证的无缝闭环。

Vizcom官方 / ADK编译 4 分钟
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
code · 免费
★ 5.0 · 120评测
�

昇思MindSpore

华为开源的自研AI深度学习框架

昇思MindSpore是华为推出的适用端边云场景的新型开源全场景深度学习框架,昇思MindSpore具备强大的分布式训练能力,内置多种并行策略,简化大模型开发。昇思MindSpore与昇腾处理器深度适配,充分发挥硬件性能,缩短训练时间并提升推理效率。昇思MindSpore支持AI与高性能计算(HPC)融合,满足AI for Science场景需求。昇思MindSpore生态丰富,提供开源项目、案例和SOTA模型,方便开发者快速上手和应用。

查看 昇思MindSpore 使用教程与功能