Udio 发布 Voices 功能:实现跨歌曲人声复刻与风格融合新玩法
Udio 近日在其官方博客宣布了一项重大更新——Voices功能。这一功能标志着 AI 音乐生成从单纯的“风格模仿”迈向了更精细的“人声特征迁移”阶段,允许创作者将一首歌曲中独特的人声特质(Voice)应用到新的创作中,甚至与其他歌曲的人声进行混合。
核心突破:Voice vs. Style
Udio 明确区分了本次发布的 Voices 功能与其互补的 Styles 功能:
- Styles: 用于让新歌曲匹配现有的音乐风格(如流行、爵士等)。
- Voices: 专注于捕捉并复用特定的人声特征,无论该人声来自 Udio 的 Voices 库还是用户自己的歌曲。
功能特性与使用场景
1. 灵活的创作入口
Voices 功能可在两个主要工作流中使用:
- Playground (游乐场): 适合快速实验。用户可随机搭配 Voice & Style,或手动选择。需注意,在此模式下无法指定精确歌词,仅能描述大致主题。
- Create (创作): 适合深度定制。用户可选择文本提示或风格参考,并在此激活 Voice Control,通过拖拽或点击添加人声。
2. 高级控制与混合
- Strength 调节: 用户可调整人声的强度(Strength)。官方提示默认设置通常效果最佳,且最大强度并不一定代表最高相似度,需根据流派和风格进行实验。
- Voices Blending (人声混合): 允许用户选择两首参考歌曲,通过滑块指定每首歌曲对人声特征的贡献比例,创造出独一无二的混合音色。
3. 人声保存与复用机制
这是该功能的一大亮点,解决了“一次性使用”的痛点:
- 使用: 在创作中激活 Voice Control 并选择目标人声。
- 保存: 使用后可将人声保存至“Saved”标签页。
- 复用: 后续创作中,可从 Saved 列表重新加载该人声,甚至可重命名以便管理。
限制与注意事项
尽管功能强大,Udio 也设定了明确的边界,以确保模型训练的稳定性:
- 来源限制: 仅支持使用 Voices 库中的声音或 Udio 原生歌曲的声音。不支持用户上传自己的音频文件作为人声源。
- 时间窗口: 2024 年 6 月及之前创建的歌曲无法作为人声源。
- 版权隔离: 非用户本人创作的歌曲(即非原创歌曲)无法被提取人声特征。
- 关联音频: 任何与用户上传音频关联的歌曲(如 Remix、Extension)均不可用。
开发者价值与应用前景
对于开发者而言,Voices 功能提供了更细粒度的控制参数(如 Strength),便于构建基于人声克隆的 API 服务。对于普通用户,这极大地降低了“模仿特定歌手”的门槛,无需依赖外部工具即可在 Udio 内部完成人声迁移和混合创作。正如 Udio 团队在文末幽默地透露,这些声音背后是工程师的辛勤工作,而非所谓的“会唱歌的仓鼠”,体现了其在音频建模技术上的深厚积累。
注:目前 Voices 功能已在网页端及移动端网页版上线,iOS App 暂未支持。