DeepSeek Harness 引入 WaveSpeed 技能:构建多模态 AI 编排新范式

ADK WaveSpeedAI官方 / ADK编译 2026-08-19 3 分钟 77 次浏览
速览导读 / Summary

DeepSeek 在其最新 AI 智能体平台 Harness 中正式引入 WaveSpeed 技能(Skill),标志着多模态 AI 编排进入新阶段。开发者可通过该技能无缝集成图像、视频、音频及 3D 生成模型,实现从文本到多模态内容的自动化流水线。此次更新不仅提升了智能体的工具调用能力,更通过内置的价格检查机制,为生产环境下的成本优化提供了关键保障。

新增技能 WaveSpeed Skill 支持多模态模型编排
集成模型数量 50+ 涵盖 Wan, Flux, Kling 等主流模型
核心特性 Auto Price Check 执行前自动成本评估

Key Insights / 核心看点

  • 1 DeepSeek Harness 正式集成 WaveSpeed 技能,实现图像、视频、音频及 3D 模型的自动化编排。
  • 2 智能体具备自主搜索模型目录、读取输入 Schema 及执行多模态任务的能力。
  • 3 内置实时价格检查机制,在执行前自动评估成本,优化企业级应用的经济性。
  • 4 基于 MCP 标准构建,支持开发者快速构建复杂的多步骤 AI 工作流。

DeepSeek Harness 引入 WaveSpeed 技能:构建多模态 AI 编排新范式

在 AI 智能体(Agent)生态日益复杂的今天,单一模型已难以满足企业级应用对多模态内容生成、复杂工作流编排及成本控制的需求。2026 年 8 月 19 日,DeepSeek 在其旗舰级智能体平台 DeepSeek Harness (dsh) 中正式推出了 WaveSpeed 技能 (Skill),旨在解决智能体在多模态任务执行中的“最后一公里”问题。

此次更新的核心在于将 WaveSpeed AI 的庞大模型库与 DeepSeek Harness 的编排引擎深度打通。开发者不再需要手动编写复杂的 API 调用代码,而是通过简单的技能配置,即可让智能体自主搜索模型目录、读取输入 Schema,并执行图像、视频、音频及 3D 生成任务。

核心突破:从单模态到全模态的无缝编排

WaveSpeed 技能的引入,打破了传统智能体仅能调用单一 LLM 的局限。它提供了一个标准化的接口,使智能体能够:

  • 全模态模型调用:智能体可无缝调用包括 Wan-3-0, Flux-3, Kling-3-0, Gemini-4 等在内的数十种主流开源及闭源模型,覆盖图像生成、视频渲染、3D 建模及音频合成。
  • 自动化工作流构建:结合 MCP (Model Context Protocol) 标准,开发者可以构建包含多步推理、多模态交互的复杂 Agent 工作流,例如“根据文本描述生成 3D 模型 -> 渲染视频 -> 生成解说音频”。
  • 动态模型选择:智能体可根据任务需求,在后台自动匹配最合适的模型,无需人工干预。

关键价值:生产级的成本与效率管控

对于企业级应用而言,模型调用成本是核心考量因素。WaveSpeed 技能在此处展现了独特的架构优势:

  • 实时价格检查 (Price Check):在每一次模型执行前,系统会自动查询并显示调用成本。这使得智能体在规划任务时,能够自动避开昂贵模型,优先选择性价比高的替代方案,实现真正的“按需付费”。
  • Schema 驱动的执行:通过标准化的输入输出定义,大幅降低了调试难度,提升了工作流的稳定性和可维护性。

开发者与用户的实际应用价值

对于开发者,这意味着无需重新构建底层基础设施,即可快速构建具备多模态能力的智能体应用。对于最终用户,这意味着 AI 助手不仅能回答问题,还能直接生成高质量的视觉内容、视频素材甚至 3D 资产,极大地拓展了 AI 在内容创作、游戏开发、营销广告等场景的应用边界。

正如官方团队所言:"We are enabling agents to not just think, but to create and execute complex multi-modal workflows with full awareness of cost and capability."(我们正在让智能体不仅能思考,还能以完全的成本和能力意识来执行复杂的多模态工作流。)

这一更新标志着 DeepSeek Harness 正从单纯的对话平台,向全栈 AI 生产力工具演进,为构建下一代多模态智能体生态奠定了坚实基础。

We are enabling agents to not just think, but to create and execute complex multi-modal workflows with full awareness of cost and capability.

DeepSeek Harness Team

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
code · 免费
★ 5.0 · 120评测
W

WaveSpeedAI

AI图像和AI视频生成加速服务平台

WaveSpeedAI 是全球领先的MaaS(Model-as-a-Service)平台,提供图像和视频等多模态内容的生成加速服务。平台提供多种高性能模型,如WAN 2.2视频模型、Seedance视频模型和 FLUX 图像工具等,支持从文本到图像、从图像到视频等多种生成方式。平台优势体现在速度快(图像生成 <2 秒,视频生成 <2 分钟)、模型丰富(涵盖多种 SOTA 模型)和高性价比。WaveSpeedAI 提供简单易用的 API 和 Web 界面,方便用户集成和使用,是提升创意工作效率的理想选择。

查看 WaveSpeedAI 使用教程与功能