Udio 发布「Styles」功能:通过音频片段与歌曲参考重塑音乐创作范式

ADK Udio官方 / ADK编译 2025-03-31 3 分钟 154 次浏览
速览导读 / Summary

Udio 正式推出「Styles」功能,允许用户通过上传音频片段或引用现有 Udio 歌曲作为风格参考来生成新音乐。该功能支持单源与双源(Style Blending)混合创作,用户可直观调整风格强度与权重比例。相比传统的文本提示词(Prompt-based)创作,「Styles」通过‘展示而非描述’的方式,显著降低了风格迁移的门槛,并支持 50/50 的混合比例实验,为音乐人提供了更精准、高效的创作工具。

上下文窗口 32 秒 单首参考歌曲的最大处理时长
风格混合比例 50/50 (默认) 双源风格混合的最佳推荐比例
默认风格强度 80% 单源参考模式下的默认风格权重

Key Insights / 核心看点

  • 1 引入「Styles」功能,支持通过音频片段或现有歌曲作为参考,实现‘展示而非描述’的创作方式。
  • 2 新增「Style Blending」(风格混合)功能,允许用户以 50/50 比例混合两首歌曲的风格,并支持自定义权重。
  • 3 支持超过 32 秒参考歌曲的局部裁剪,确保 AI 仅学习用户指定的核心风格片段。
  • 4 基于音频上传的风格参考生成歌曲无法在 Udio 平台直接发布,仅限私有分享或外部分发。

Udio 发布「Styles」功能:通过音频片段与歌曲参考重塑音乐创作范式

Udio 近日在其官方博客宣布了一项重大更新——「Styles」功能。这一功能旨在解决音乐创作者在描述心中旋律时面临的痛点,允许用户通过上传音频片段或引用现有 Udio 歌曲作为风格参考,从而更精准地捕捉并生成目标音乐风格。

核心突破:从“描述”到“展示”

传统的 AI 音乐生成主要依赖文本提示词(Text-to-Audio),用户往往需要花费大量精力用语言描述音色、节奏和情感。而「Styles」功能彻底改变了这一流程,它让创作者能够通过展示(Show)而非描述(Describe)来定义新歌曲的基调。

风格来源的多样性

「Styles」支持四种核心参考来源:

  1. Udio 上的自有歌曲:直接引用您在平台上的作品。
  2. Udio 上的他人歌曲:借鉴社区中的其他创作(Pro 订阅者可调整权限设置)。
  3. 音频上传:支持上传任意音频片段作为风格样本。
  4. 风格库(Style Library):平台内置的精选风格选项。

风格混合(Style Blending)

对于追求创意混搭的用户,「Styles」引入了强大的风格混合功能。用户可以同时选择两首参考歌曲(或一首歌曲加一段音频),并通过滑块直观地调整两者的相对影响力。

  • 50/50 混合:系统默认推荐 50/50 的比例,通常能产生最佳效果。
  • 微调控制:用户可向左或向右拖动滑块,微调风格权重(建议偏差控制在±15% 以内)。
  • 跨类型融合:支持将合唱(Choral)与雷鬼(Reggae)等截然不同的风格进行融合,甚至设定相对权重。

注意:风格混合(Style Blending)目前为订阅用户专属功能,但平台已宣布该功能将在 7 月 24 日之前向所有用户开放。

技术细节与使用指南

上下文窗口与裁剪

当参考歌曲长度超过 Udio 的32 秒上下文窗口时,用户可以使用鼠标拖动红色区域,仅选择歌曲中希望被引用的特定片段。这确保了 AI 学习的是最核心的风格特征,而非冗余内容。

风格强度调节

在单源参考模式下,用户可调整「Style Strength」参数:

  • 100%:AI 将完全优先利用参考歌曲的特征。
  • 0%:相当于未进行风格化。
  • 默认 80%:系统推荐的最佳平衡点,既保留风格又允许一定的创造性发挥。

版权与发布限制

在使用音频上传作为风格参考时,存在严格的版权与发布限制:

  • 使用权:上传者必须拥有该音频的合法版权。
  • 发布禁令:任何基于音频上传(或基于此类上传歌曲)生成的歌曲,无法在 Udio.com 上直接发布。用户只能将其作为私有创作分享,或下载为音频/视频文件后在外部平台分发。

实际价值与应用场景

「Styles」功能的推出,标志着 Udio 从单纯的文本生成工具向智能风格迁移与 remix 工具的进化。

  1. 降低创作门槛:对于难以用文字精准描述风格的初学者,上传一段喜欢的旋律或节奏片段即可快速生成类似作品。
  2. 高效 Remix 与采样:音乐人可以利用该功能快速将流行歌曲转化为纯器乐版本,或将不同时代的音乐风格进行融合实验。
  3. 迭代优化:用户可将满意的风格保存至「Your Styles」面板,在后续创作中随时调用,形成个性化的风格库。

Udio 团队表示,「Styles」提供了最全面的能力,涵盖了乐器构成、人声音色、速度、整体音色色彩及歌曲结构等多个维度。虽然「Remix」功能侧重于节奏与和声核心的复刻,而「Extend」侧重于续写,但「Styles」则是通过深度风格学习来实现的创造性转化。

对于希望探索 AI 音乐边界的开发者与创作者而言,「Styles」无疑是一个极具潜力的新工具,它将极大地丰富 AI 生成内容的多样性与可控性。

“The Styles feature enables you to create new songs using one or two audio clips and/or an existing Udio songs as style references, capturing a vibe more easily than ever before!”

— Udio 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟
audio · 免费+付费
★ 5.0 · 120评测
U

Udio

免费的AI音乐创作工具,每月可生成1200首歌曲

Udio是一款由前Google DeepMind研究人员创立的人工智能音乐生成器,旨在让任何人都能够轻松地创作出具有情感共鸣的音乐。该AI音乐生成工具能够根据用户输入的文本提示,包括音乐风格、主题、歌词等信息,快速生成包含人声的完整音轨。Udio不仅支持多种音乐风格和流派,还能够捕捉并表达音乐中的情感,创造出既逼真又具有创意的音乐作品。 Udio的设计理念是作为一个“超级乐器”,放大人类的创造力。适合音乐家和业余爱好者使用,提供了一个平台,让用户可以通过简单的文本输入,体验从零到创作出音乐的“魔法时刻”。Udio拥有与Suno类似的从文本提示创建完整曲目的能力,但具有更好的声音和更自然的声音。

查看 Udio 使用教程与功能