可灵 AI 发布 Kling VIDEO 3.0 Omni:四步实现图片动态化,支持多角色元素参考与多镜头时序控制

ADK 可灵AI官方 / ADK编译 2026-09-30 5 分钟 139 次浏览
速览导读 / Summary

可灵 AI 正式发布 Kling VIDEO 3.0 Omni 模型,大幅提升了从静态图片生成视频的能力。该更新引入了强大的“元素参考(Element Reference)”功能,确保多镜头视频中人物或物体的一致性,并支持多镜头(Multi-shot)时序提示词,允许用户精确控制每个镜头的时长与动作。用户仅需上传图片并描述运动,即可在四步内生成高质量短视频,适用于广告演示、影视预演及创意内容制作。

模型版本 Kling VIDEO 3.0 Omni 支持多镜头时序控制与元素参考
单生成长度 15 秒 单次生成视频的最大时长
操作步数 4 步 从上传图片到生成视频的简化流程

Key Insights / 核心看点

  • 1 发布 Kling VIDEO 3.0 Omni 模型,显著提升了图像转视频的质量与可控性。
  • 2 引入 Element Reference 功能,在多镜头视频中保持人物与物体的身份一致性。
  • 3 支持 Custom Multi-Shot 时序提示词,允许用户精确规划每个镜头的动作与时长。
  • 4 单帧生成时长支持高达 15 秒,并原生支持音频生成与多镜头拼接。

可灵 AI 发布 Kling VIDEO 3.0 Omni:四步实现图片动态化

在静态图片捕捉瞬间的同时,动画赋予了想象未来的能力。可灵 AI(Kling AI)近日发布了其最新的视频生成模型 Kling VIDEO 3.0 Omni,旨在通过极简的操作流程,让用户仅需一张图片和一段提示词,即可将静止画面转化为生动流畅的短视频。

核心突破:从单帧到多镜头的质变

Kling VIDEO 3.0 Omni 不仅优化了基础的图像转视频(Image-to-Video)能力,更在复杂场景控制上实现了重大突破。针对以往生成视频中人物变形、物体不一致的痛点,新模型引入了 Element Reference(元素参考) 机制。这一功能允许用户在生成多镜头视频时,将特定人物或物体作为“锚点”固定,确保其在场景变换、视角切换中始终保持身份与视觉特征的可识别性。

此外,模型原生支持 Custom Multi-Shot(自定义多镜头) 提示词。用户不再受限于单镜头生成,而是可以像导演一样,为不同的镜头分配时长(最高支持 15 秒单生成长度),并详细描述每个镜头的动作、构图及转场逻辑。这种时序控制能力,使得生成具有叙事性的短视频成为可能。

四步操作指南:让图片“活”起来

可灵 AI 将复杂的视频生成流程简化为四个清晰的步骤,用户只需关注创意表达:

  1. 上传参考图片:上传作为起点的静态图片。若需控制多镜头中的人物一致性,可将其设为 Element Reference。同时,用户也可添加 End Frame 来限定视频的结束画面。
  2. 描述运动意图:编写提示词(Prompt),明确指定主体动作(如“人物转身微笑”)、环境变化(如“水面涟漪”)以及相机运动(如“推镜头”或“环绕”)。对于多镜头场景,需按时间顺序描述每个镜头的指令。
  3. 设定时长并生成:根据动作复杂度选择时长。Kling VIDEO 3.0 Omni 支持单生成长达 15 秒,或通过多镜头拼接实现更长的叙事视频。用户还可在此步骤开启原生音频生成。
  4. 审查与微调:预览生成的视频,检查主体动作是否自然、细节是否保持清晰。若发现镜头缺失或衔接生硬,可针对性地优化提示词并重新生成。

实际应用场景

该更新特别适用于需要高度可控性的垂直领域:

  • 商业广告与产品展示:利用元素参考保持产品(如口红、汽车)在动态镜头中的完美形态。
  • 影视预演与分镜制作:通过多镜头时序控制,快速生成带有运镜和台词的预演视频。
  • 社交媒体创意内容:将静态插画转化为动态 GIF 或短视频,提升内容吸引力。

正如可灵 AI 团队所言,"我们的目标是将创意从静态的像素中释放出来,让每一位创作者都能通过简单的指令,构建出动态的视觉故事。" Kling VIDEO 3.0 Omni 的发布,标志着 AI 视频生成从简单的‘动起来’迈向了‘精准控制’的新阶段。

“我们的目标是将创意从静态的像素中释放出来,让每一位创作者都能通过简单的指令,构建出动态的视觉故事。”

— 可灵 AI 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟
image · 免费+付费
★ 5.0 · 120评测
�

可灵AI

快手推出的AI图像和视频创作平台

可灵AI是快手推出的AI图像和AI视频创作平台,提供网页版和手机APP。支持AI图片和AI视频生成功能,AI图片生成支持文生图和图生图,用户可以输入描述或上传图片,AI据此生成新的图片。AI视频生成能将文本或图片转化为生动视频,具备视频延长和高清画质升级特性。用户能自定义首尾帧生成视频,享受丰富的视频编辑功能,如多种镜头控制选项。提供了多人协同创作的平台,支持最多5人同时在一个画布内进行创作,实现素材共享、实时联动和一键导出,通过“灵动画布”,创作者可以将零散的创意想法转化为文本、图像或视频节点,高效串联成完整的视觉作品。 可灵AI最新上线的AI数字人功能,支持用户上传一张角色图片和一段文字或音频,能生成高清数字人视频,基于Transformer的DiT架构,能实现口型精准同步与情绪动作精细控制,支持多种角色和语言,画质1080p,帧率48FPS,成本低至0.12元/秒。 可灵数字人 2.0 已正式上线,只需三步,上传角色图、添加配音、描述表现,即可生成表现力十足的数字人视频。此次升级支持手部和口型精准控制,单次生成最长可达 5 分钟,知识讲解和表演都能生动呈现。

查看 可灵AI 使用教程与功能