ElevenLabs 发布 Dubbing v2:AI 配音实现跨语言情感与表演完美复刻

ADK ElevenLabs官方 / ADK编译 2026-05-28 4 分钟 73 次浏览
速览导读 / Summary

ElevenLabs 正式推出革命性的 Dubbing v2 模型,彻底改变 AI 配音行业。该模型不再依赖文本转录,而是直接基于原始音频的表演条件进行生成,成功将说话者的情感、语调、节奏及情绪意图完整迁移至 90 多种语言。此举解决了传统 AI 配音“翻译腔”重、情感缺失的痛点,支持视频一键本地化,并推出了针对创作者的合作伙伴计划,大幅降低多语言内容制作门槛。

支持语言数量 90+ 覆盖全球主要语言市场
技术架构 Performance-based Conditioning 从文本驱动升级为表演驱动
免费试用额度 1-30 分钟 根据订阅计划不同,提供从 1 到 30 分钟的免费试用

Key Insights / 核心看点

  • 1 Dubbing v2 模型不再依赖文本转录,而是直接基于原始音频的表演条件生成,完美复刻说话者的情感与语调。
  • 2 支持 90 多种语言,内置同步感知系统,自动对齐节奏与停顿,实现专业级的多语言本地化。
  • 3 推出 Creator Dubbing Partner Program,降低创作者使用门槛,支持视频一键全球分发。
  • 4 大幅降低多语言内容制作成本,使中小企业和个人创作者也能以专业水准进行全球化内容营销。

ElevenLabs 发布 Dubbing v2:AI 配音实现跨语言情感与表演完美复刻

今天,ElevenLabs 正式推出了其革命性的 Dubbing v2 AI 配音模型。这一更新标志着 AI 语音技术从“文本转语音”向“表演转语音”的跨越,旨在解决长期以来困扰行业的一个核心难题:如何让翻译后的语音听起来像是由原始说话者本人用目标语言说出来的。

核心突破:从文本转录到表演复刻

传统的 AI 配音系统主要依赖文本转录(Transcripts)。虽然能生成准确的翻译,但往往丢失了人类语言中至关重要的细微差别,如情感、停顿、强调、犹豫和能量。Dubbing v2 采用了完全不同的架构思路:

  • 基于原始表演的条件生成:模型不再仅处理文本,而是直接以原始音频的表演为条件。它捕捉说话者的音调和语气,并将其无缝迁移到目标语言中。
  • 自然的多语言交付:不同语言需要不同的措辞、节奏和句法结构才能自然流畅。Dubbing v2 具备同步感知(Sync-aware)的翻译系统,能够自动对齐起始、停止和节奏,大幅减少人工调整需求,使最终输出更接近专业配音水平。

关键价值与应用场景

1. 为创作者:一键全球分发

对于内容创作者而言,Dubbing v2 使得在 ElevenCreative 中通过“一键”操作即可将视频本地化成为可能。视频内容现在可以在不同语言受众中听起来自然,同时保留原始创作者的个人风格和表达力。这极大地加速了全球分发速度,无需牺牲质量。

2. 为营销团队:规模化本地化

营销团队可以利用 Dubbing v2 在国际市场进行高质量的内容本地化,而无需从头重建活动。广告、产品视频和品牌内容可以在不同语言中保持相同的情感冲击力和交付风格。

3. 为工作室:专业级工作流

对于广播公司和企业制作团队,ElevenProductions 将 Dubbing v2 与专业本地化服务(如人工翻译、专家配音和音频混音)相结合。这种组合提供了一个可扩展的工作流,实现了专业级的多语言制作。

合作伙伴计划与获取方式

随着 Dubbing v2 的发布,ElevenLabs 还推出了 Creator Dubbing Partner Program。符合条件的创作者将获得折扣访问权限,具体申请方式请查看官网。

免费试用政策

  • Free 计划:1 分钟免费使用
  • Starter 计划:15 分钟免费使用
  • Creator+ 计划:30 分钟免费使用

API 访问功能即将推出,企业用户可通过联系销售团队了解详情。

“我们的目标是让高质量的多语言内容创作变得像发送电子邮件一样简单,同时保留原始表演的神韵。” —— ElevenLabs 官方团队

For the first time, the emotion and performance of the original speaker carries across every language.

ElevenLabs 官方公告

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
audio · 免费+付费
★ 5.0 · 120评测
E

ElevenLabs

AI文本转语音,支持包含中文在内的29种语言

ElevenLabs 是AI文字转语音平台,为开发者、创作者和企业提供逼真的语音合成解决方案。核心产品包括文本转语音(支持包括中文在内的 29+ 语言、10,000+ 声音)、AI 配音、语音克隆、音乐生成等功能。平台以超低延迟、情感丰富的语音质量著称,广泛应用在有声书、视频配音、客服中心和内容本地化等场景。

查看 ElevenLabs 使用教程与功能