ElevenLabs 发布 Expressive Mode:语音代理迎来情感智能革命

ADK ElevenLabs官方 / ADK编译 2026-02-10 4 分钟 110 次浏览
速览导读 / Summary

ElevenLabs 正式推出 Expressive Mode,旨在通过 Eleven v3 Conversational 模型与全新轮次交互系统,赋予语音代理前所未有的情感控制力。该更新不仅优化了语调调节与情绪感知,还实现了 70 多种语言的情感细腻表达,帮助企业在高压力客服场景中实现更自然、更具同理心的沟通体验。

模型版本 Eleven v3 Conversational 情感智能与上下文感知能力全面升级
支持语言数量 70+ 覆盖全球主要语言,优化情感表达
实时情绪识别 Scribe v2 Realtime 从语音中推断用户情绪状态

Key Insights / 核心看点

  • 1 推出 Expressive Mode,赋予语音代理动态调整语调与情绪的能力,实现更自然的对话体验
  • 2 基于 Eleven v3 Conversational 模型,支持多轮对话中的情感感知与上下文保持
  • 3 引入新轮次交互系统,利用 Scribe v2 Realtime 实时推断用户情绪并优化响应时机
  • 4 支持 70+ 语言,特别优化印地语、西班牙语等语言的情感表达细腻度

ElevenLabs 发布 Expressive Mode:语音代理迎来情感智能革命

在 AI 语音交互领域,ElevenLabs 今天宣布了一项重大突破——Expressive Mode(情感表达模式)。这一更新专为 ElevenAgents 打造,旨在模糊 AI 与人类对话之间的界限,让语音代理能够根据用户情绪动态调整语调,从安抚焦虑到引导解决,实现真正“有温度”的客户服务。

核心突破:双重引擎驱动情感智能

Expressive Mode 并非单一功能的叠加,而是由两项核心技术升级共同驱动:

1. Eleven v3 Conversational:最懂情绪的大模型

这是 ElevenLabs 迄今为止最具情感智能和上下文感知能力的文本转语音(TTS)模型。与以往版本不同,Eleven v3 Conversational 专为实时对话优化,能够:

  • 保持上下文连贯:在多轮对话中精准维持语境;
  • 反映意图与情绪:语音自然流露情感与重音,避免机械感;
  • 支持动态语调控制:允许开发者根据用户情绪(如担忧、愤怒、惊喜)实时调整代理的说话风格,例如在用户焦虑时采用更温和、安抚的语调。

2. 全新轮次交互系统:像人一样“听”与“说”

人类对话不仅取决于说什么,更取决于何时说。Expressive Mode 引入的新轮次交互系统,利用行业领先的 Scribe v2 Realtime 实时转录模型,从语音中推断情绪状态,从而决定代理何时发言、何时停顿或等待。

例如:

  • 语速突然加快、音量激增、重复发言 → 系统识别为急性压力或恐慌,代理会放缓节奏、语气更沉稳;
  • 明亮上升语调、短促感叹 → 识别为惊喜或释然,代理会回应得更积极、富有共情。

全球化部署:70+ 语言的情感细腻表达

Expressive Mode 已支持全球 70 多种语言,特别优化了以往情感表达较弱的语言,如印地语、西班牙语(含阿根廷口音)等,确保跨文化场景下的情感传达同样精准细腻。

实际应用价值

对于企业而言,Expressive Mode 意味着:

  • 提升客户满意度:在高压力场景下(如航班取消、订单延误),代理能真正“共情”用户,而非机械回复;
  • 强化品牌一致性:通过精细的语调控制,确保代理声音始终符合品牌调性;
  • 规模化部署就绪:已集成至 ElevenAgents 平台,具备生产级可靠性、监控与测试能力,支持从试点到全球推广的全流程落地。

“我们的目标是让 AI 不再只是‘回答问题’,而是真正‘与人交谈’。”——ElevenLabs 官方团队

开发者可通过官方文档与 Live Demo 立即体验 Expressive Mode,构建更具人性化的智能语音代理。

Expressive Mode gives teams unprecedented control over tone - so agents can de-escalate, reassure, and guide conversations to a clear resolution, even under pressure.

ElevenLabs 官方团队

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
audio · 免费+付费
★ 5.0 · 120评测
E

ElevenLabs

AI文本转语音,支持包含中文在内的29种语言

ElevenLabs 是AI文字转语音平台,为开发者、创作者和企业提供逼真的语音合成解决方案。核心产品包括文本转语音(支持包括中文在内的 29+ 语言、10,000+ 声音)、AI 配音、语音克隆、音乐生成等功能。平台以超低延迟、情感丰富的语音质量著称,广泛应用在有声书、视频配音、客服中心和内容本地化等场景。

查看 ElevenLabs 使用教程与功能