Suno 发布 Speech 功能:首款将语音与音乐融合生成的音频模型

ADK Suno官方 / ADK编译 2026-10-01 4 分钟 89 次浏览
速览导读 / Summary

Suno 正式推出 Speech 功能(Beta 版),这是其首款能够同时生成人声与背景音乐的音频模型。该功能允许用户输入文本、诗歌或想法,并自定义语音风格与音乐类型,从而创造出带有原创配乐的对白、朗诵或故事。此举标志着 Suno 从单纯的音乐生成向全场景音频创作工具的跨越,极大地扩展了创作者将文字转化为个性化音频内容的边界。

功能版本 Speech Beta 首款语音与音乐融合生成模型
支持输入类型 文本/诗歌/想法 可自定义语音特征与音乐风格

Key Insights / 核心看点

  • 1 Suno 发布 Speech 功能,成为首款能同时生成人声与背景音乐的音频模型,实现语音与音乐的无缝融合。
  • 2 支持用户自定义语音风格(如口音、情感)和音乐类型,将文本、诗歌快速转化为带有原创配乐的完整音频。
  • 3 开放 Beta 测试,鼓励社区探索创意边界,从戏剧性朗诵到个性化故事,拓展了音频创作的可能性。
  • 4 标志着 Suno 从单一音乐生成平台向全场景音频创作工具的转型,降低了将文字转化为多媒体内容的门槛。

Suno 发布 Speech:首款语音与音乐融合的音频生成模型

在技术不断推动创作门槛降低的今天,将创意转化为音乐、故事或艺术作品的过程,正成为定义下一代消费技术的重要力量。Suno 始终将音乐置于核心,但其愿景早已延伸至人类表达的更广阔领域。今天,Suno 正式宣布推出 Speech 功能,这是业界首款能够生成人声与背景音乐作为统一连贯轨道的音频模型。

核心突破:从“配乐”到“融合”

Speech 的核心创新在于打破了语音与音乐分离的传统界限。它允许用户输入一段文字、一首诗或任何构思,并详细描述所需的语音特征(如语调、口音)及音乐风格(如节奏、乐器编配)。系统随即生成一段带有原创背景音乐的完整音频。

这一技术突破源于开发团队在测试过程中发现的诸多有趣应用场景:将朋友的文字转化为过度制作却极具戏剧张力的朗诵,为普通的语音备忘录配上史诗般的配乐,或是为家人制作冥想、睡前故事等。这些看似简单的创意,实际上是对 Suno 原有创作生态的自然延伸。

开放 Beta 与社区共创

经过一个月的内部测试,Suno 现已向所有用户开放 Speech 的 Beta 版本。团队强调,Beta 意味着 Beta,音频生成过程中可能会出现有趣的“意外”,例如英式口音偶尔会“漂移”到澳大利亚,或者戏剧性的停顿表现得过于夸张。然而,正是这些不可预测性激发了用户的无限可能。

Suno 表示,他们期待社区能探索出更多意想不到的用法,并将在迭代过程中持续优化模型,以平衡创意表达与技术稳定性。

实际应用价值

对于开发者而言,Speech 提供了新的 API 调用场景,可用于构建个性化播客、动态背景故事生成器或教育类音频应用。对于普通用户,这则意味着创作工具能力的质变:不再需要分别寻找配音演员和作曲家,只需输入文字,即可瞬间获得充满情感与氛围的完整音频作品。

正如 Suno 团队所言:"Speech 是另一种将想法转化为个性化、有意义或令人愉悦作品的方式。我们迫不及待地想看看你们会用它创造出什么。"

“Speech is one new way to turn an idea into something personal, meaningful or delightful. We've had a lot of fun exploring what's possible with it. Now we can't wait to see what you make.”

— Suno 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟