LALAL.AI 发布 Andromeda 模型:新增全类吉他分离与重训钢琴 Stem

ADK LALAL.AI官方 / ADK编译 2026-08-27 5 分钟 152 次浏览
速览导读 / Summary

LALAL.AI 宣布其最新音频分离模型 Andromeda 正式支持吉他(Guitars)与钢琴(Piano)Stem。全新吉他 Stem 将原分开的原声与电吉他合并为单一类别,通过简化分类逻辑将分离错误率降低约 20%。同时,钢琴 Stem 基于 Andromeda 架构从零重新训练,显著提升了复杂混音中的分离纯净度。旧版 Orion/Perseus 模型仍保留以兼容现有工作流。

新 Stem 类型 Guitars, Piano 新增单一吉他类别与重训钢琴 Stem
吉他分离错误率 -20% 相比旧版 Perseus 模型的分离失败频率降低
架构版本 Andromeda v6 基于全新神经网络架构
兼容旧版 Yes Orion/Perseus 模型仍可通过设置切换使用

Key Insights / 核心看点

  • 1 新增 Guitars Stem:将原声与电吉他合并为单一类别,消除分类错误导致的乐器碎片化问题。
  • 2 分离精度提升:针对吉他分离的失败案例(如部分丢失或音色单薄),错误率降低约 20%。
  • 3 钢琴全面重训:基于 Andromeda 架构从零训练,显著改善复杂混音中钢琴的分离纯净度与动态表现。
  • 4 旧版兼容保留:Acoustic Guitar 和 Electric Guitar Stem 继续可用,满足不同精细分离需求。
  • 5 全平台同步:Web、API、iOS、Android 及桌面端均支持新模型功能。

LALAL.AI Andromeda 模型升级:吉他分离精度突破与钢琴全面重训

LALAL.AI 近日在其官方博客中宣布,其旗舰级音频分离模型 Andromeda 迎来了重大功能更新。此次更新不仅将 Piano(钢琴)Guitars(吉他) 正式纳入单一网络的处理范围,更在算法架构与训练数据上实现了质的飞跃,标志着 LALAL.AI 在复杂乐器分离领域的又一里程碑。

核心突破:吉他 Stem 的范式转移

此前,LALAL.AI 的吉他分离功能(自 Orion 及 Perseus 版本起)将吉他细分为 Acoustic Guitar(原声吉他)Electric Guitar(电吉他) 两个独立 Stem。然而,这种细分在处理混合编曲时往往面临挑战:模型需要在每个片段中不断判断“这是原声还是电吉他”,一旦判断失误,会导致同一把吉他被错误地拆分到两个 Stem 中,产生“半音”或音质单薄的问题。

Andromeda 引入了全新的 Guitars Stem,其核心理念是“全类合并”。无论原声、电吉他还是介于两者之间,所有吉他内容均被提取至同一个 Stem 中。

技术优势与数据表现

  1. 消除分类歧义:通过移除“原声/电吉他”的二选一判断逻辑,彻底消除了因分类错误导致的乐器碎片化问题。官方测试数据显示,此类分离失败(即吉他被拆分或丢失)的频率较旧版本降低了约 20%
  2. 训练数据优化:LALAL.AI 实验室确认,将吉他作为一个单一类别进行标注的数据质量优于之前的细分标注,这直接提升了模型对复杂吉他音色(如失真节奏与清音旋律共存)的识别能力。

注意:新的 Guitars Stem 不会区分吉他类型。如果曲目中同时存在原声扫弦与失真独奏,它们将混合在同一 Stem 中输出。

钢琴 Stem:基于 Andromeda 的从零重训

钢琴 Stem 在 Andromeda 架构下经历了彻底的重新训练。与旧版相比,新模型在处理高频泛音、长延音以及密集和弦段落时表现更为出色。

  • 更纯净的分离:显著减少了钢琴与其他乐器(如人声、贝斯)的频率重叠(Bleed)。
  • 更自然的音色:保留了钢琴丰富的动态范围,解决了旧模型在复杂段落中钢琴部分“断裂”或“空洞”的问题。

兼容性与多端部署

LALAL.AI 采取了平滑过渡策略,Perseus 版本中的 Acoustic Guitar 和 Electric Guitar Stem 将继续保留,用户可根据需求选择:

  • 追求极致纯净度:优先选择新的 Guitars Stem,适用于伴奏制作、翻唱、混音及转录等场景。
  • 需要精细分离:若曲目仅包含单一类型的吉他,或需严格区分原声与电吉他,继续使用旧的 AcousticElectric Stem。

新功能已全面上线:

  • Web 端:Stem Splitter 与 Vocal Remover 工具已更新界面。
  • API:开发者可直接调用新模型,无缝集成至自有产品。
  • 移动端:iOS 和 Android 应用现已支持新吉他 Stem 及重训钢琴。
  • 桌面端:Andromeda 版本在云端模式下运行。

LALAL.AI 表示,此次更新旨在解决乐器分离中最棘手的“高频重叠”与“分类模糊”难题,为创作者提供更可靠的音频处理工具。

官方引言

“吉他与钢琴是音频分离中最具挑战性的乐器,因为它们占据了极宽的频率范围且极易与其他乐器重叠。Andromeda 通过重新思考分类逻辑与数据标注,我们不仅提升了分离质量,更让复杂的音乐制作流程变得更加可靠。” —— LALAL.AI 技术团队

Guitars does what the name suggests. Select this stem, upload a track, and you get one file containing all the guitar content the model can find... failures that bother people most... occurred roughly 20% less often than before.

LALAL.AI Official Blog

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
audio · 付费
★ 5.0 · 120评测
L

LALAL.AI

AI人声乐器分离和提取

LALAL.AI是AI音乐音频处理工具,能快速、精准地将音频或视频中的人声、伴奏、鼓、贝斯等不同音轨分离,支持多种音频和视频格式(如MP3、WAV、MP4等)。工具提供免费的批量上传功能,用户能上传多达20个文件进行处理。LALAL.AI具备去除回音、混响和降噪等功能,能有效提升音频处理质量。工具提供数字声音克隆功能,帮助用户创建个性化的数字声音副本。

查看 LALAL.AI 使用教程与功能