DomoAI 发布 Omni Reference:单生成支持 50 路多模态参考,重塑长视频创作边界

ADK DomoAI官方 / ADK编译 2024-11-01 4 分钟 96 次浏览
速览导读 / Summary

DomoAI 正式推出 Omni Reference 功能,基于 Seedance 2.5 模型,允许用户在单次生成中同时输入最多 50 路参考素材(30 张图、10 段视频、10 段音频)。该功能突破了传统单图参考的局限,通过赋予每路素材明确的角色指令,显著提升了角色一致性、动作连贯性及音频同步能力,支持 4-30 秒长视频生成,为复杂叙事与商业广告制作提供了全新范式。

最大参考数量 50 包含 30 张图、10 段视频、10 段音频
生成时长上限 30 秒 单段参考最长 30 秒,总时长合计 30 秒
分辨率 720P 支持 480P 或 720P,牺牲分辨率换取时长与精度
底层模型 Seedance 2.5 字节跳动开源视频模型,未来将接入 MiniMax H3

Key Insights / 核心看点

  • 1 支持单次生成最多 50 路多模态参考(30 图 +10 视频 +10 音频),彻底打破传统单图参考限制。
  • 2 引入‘角色指令’机制,让用户为每路素材分配具体任务,显著提升模型对动作与形象的还原度。
  • 3 基于 Seedance 2.5 模型,将视频生成时长从 15 秒提升至 30 秒,并支持音频驱动的视频生成。
  • 4 兼容 MiniMax H3 模型,未来用户可在同一界面无缝切换不同模型以平衡时长与画质。

DomoAI 发布 Omni Reference:单生成支持 50 路多模态参考,重塑长视频创作边界

DomoAI 在近日推出了其最具野心的视频生成工具——Omni Reference。这一全新模块并非对现有功能的简单修补,而是基于字节跳动开源模型 Seedance 2.5 的深度集成,旨在解决当前 AI 视频创作中“角色崩坏”与“动作不连贯”的核心痛点。

突破单图局限:从“参考”到“指令”

传统的 AI 视频工具通常仅允许用户上传一张参考图或一段起止帧,这在长达 30 秒的视频生成中往往难以维持角色的面部特征与肢体动作的一致性。

Omni Reference 彻底改变了这一规则。它允许用户在一个生成任务中同时挂载多达 50 路 参考素材:

  • 30 张图片:用于定义角色外观、场景细节。
  • 10 段视频片段:用于捕捉特定的运动轨迹与动态效果。
  • 10 段音频文件:用于精确控制口型同步与声音节奏。

更重要的是,系统不再被动接收素材,而是要求用户为每一路素材分配明确的“工作指令”。例如,你可以指定某张图片负责角色身份,某段视频负责行走动作,某段音频负责背景音乐节奏。这种结构化指令机制让模型能够精准理解并执行,大幅减少了猜测带来的误差。

核心技术规格与能力边界

Omni Reference 在性能与灵活性上进行了重新定义,具体技术指标如下:

  • 生成时长:支持 4 至 30 秒 的视频生成,是现有 Seedance 2.0 版本(15 秒上限)的两倍。
  • 分辨率:提供 480P 和 720P 两种选项。虽然牺牲了部分分辨率上限以换取更长的生成时长与更强的参考控制力,但对于中长视频叙事已足够清晰。
  • 参考时长:单段视频/音频参考最长 30 秒,但所有参考素材的总时长合计不得超过 30 秒。
  • 画面比例:支持自动识别及 3:4, 4:3, 9:16, 16:9, 1:1 等多种比例。

实际应用场景与生态价值

Omni Reference 的推出标志着 AI 视频创作从“短片段特效”向“长镜头叙事”的跨越,其适用场景极为广泛:

  1. 复杂角色一致性:创作者可上传多张不同角度的角色图,确保视频全程角色形象统一,无需频繁重绘。
  2. 商业广告与 Vlog:通过输入真实的口型音频和视频片段,可实现高保真的口型同步与动作复刻,极大降低商业制作成本。
  3. 音频驱动创作:用户甚至可以不依赖任何图像或视频,仅凭一段音频即可生成匹配的视频内容,拓展了声音艺术家的创作边界。

未来展望:MiniMax H3 即将加入

DomoAI 明确表示,Omni Reference 只是其视频创作平台的起点。未来,MiniMax H3 模型将接入同一平台,届时用户可根据具体需求——是需要超长时长的多参考序列,还是高分辨率的短平快输出——灵活切换模型,无需重新整理素材库。

目前,该功能已对 DomoAI 所有账号开放,新用户可获得 30 积分体验一次 480P 4 秒的生成。随着 MiniMax H3 的加入,Omni Reference 有望成为构建高质量长视频内容的核心引擎。

“Most AI video tools let you attach a single reference image, and a single image is not enough to hold a character together for thirty seconds. So we raised the ceiling.”

— DomoAI 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
AI 工具 2026-09-24

美图 AI PPT 发布全新 Print-On-Demand 设计工作流,从创意到成品一键生成

美图 AI PPT 正式推出针对按需打印(POD)场景的专业设计解决方案,填补了通用 AI 绘图在商业落地环节的空白。该工具不仅提供从创意到样品的全链路生成能力,更内置了针对 T 恤、马克杯等实体产品的尺寸适配、安全区域预留及色彩对比度优化算法。开发者与创作者可利用其‘AI 辅助概念生成’功能,快速将模糊想法转化为符合印刷标准的可编辑矢量文件,大幅降低 POD 产品的试错成本。

美图AI PPT官方 / ADK编译 4 分钟
video · 付费
★ 5.0 · 120评测
D

DomoAI

一站式AI视频与动画创作平台

DomoAI是映刻科技推出的一站式的AI 视频与动画创作平台,国际版名为DomoAI,国内版为滴墨AI(大画家Domo)。DomoAI支持将文本、图像或视频快速转化为高质量的动漫、写实或艺术视觉内容。平台支持多种功能,如视频转视频、图像转视频、文本转视频等。DomoAI 操作直观,无需复杂软件能产出专业级作品,适合内容创作者、品牌团队等多类用户,助力高效创作,让创意轻松落地,赋能每个人的创意旅程。

查看 DomoAI 使用教程与功能