可灵 AI 发布 IMAGE 3.0 Omni 与 VIDEO 3.0 Omni:重塑图像与视频背景编辑工作流

ADK 可灵AI官方 / ADK编译 2026-09-22 4 分钟 112 次浏览
速览导读 / Summary

可灵 AI (Kling AI) 正式发布 IMAGE 3.0 Omni 与 VIDEO 3.0 Omni 功能,将背景移除从简单的抠图升级为基于提示词 (Prompt-based) 的场景重构工具。该更新支持 2K/4K 高分辨率输出,允许用户通过自然语言指令或参考图,在保留主体细节的同时,将背景替换为全新场景,显著提升了图像与视频内容的创作灵活性与商业应用价值。

图像输出分辨率 2K / 4K IMAGE 3.0 Omni 支持的高清输出标准
核心功能 Prompt-based Scene Reconstruction 基于提示词的场景重建技术
适用媒体类型 Images & Videos 同时支持静态图像与动态视频的背景编辑

Key Insights / 核心看点

  • 1 发布 IMAGE 3.0 Omni 与 VIDEO 3.0 Omni,实现从简单抠图到基于提示词的场景重构升级。
  • 2 支持 2K 和 4K 高分辨率输出,满足电商、广告及高质量视频制作需求。
  • 3 允许通过自然语言指令或参考图,将主体无缝置入全新背景,无需绿幕拍摄。
  • 4 保留主体运动轨迹与摄像机视角,确保视频背景切换后的流畅性与自然度。

可灵 AI 发布 IMAGE 3.0 Omni 与 VIDEO 3.0 Omni:重塑背景编辑新范式

在 AI 图像与视频生成领域,背景处理一直是制约内容创作效率的关键环节。传统的抠图工具往往止步于提供透明背景,难以满足现代创作者对场景融合、风格迁移及动态视频编辑的复杂需求。近日,可灵 AI (Kling AI) 在其官方博客中重点展示了其最新的核心能力升级——IMAGE 3.0 Omni 与 VIDEO 3.0 Omni,标志着其背景编辑工具从“减法”(移除背景)向“加法”(场景重构)的跨越。

核心突破:从透明抠图到场景重构

可灵 AI 此次更新的核心逻辑在于重新定义“背景移除”的价值。它不再仅仅是一个去除杂质的工具,而是成为了一个创意工作流 (Creative Workflow) 的起点。

  • IMAGE 3.0 Omni (图像多模态优化): 该功能不仅支持将主体从原图中分离出透明背景,更具备强大的场景重建能力。用户只需输入自然语言提示词 (Prompts) 或上传参考图像,即可让主体置身于全新的环境中。例如,将一位模特从办公室背景中移除,并瞬间“放置”在巴黎街头或未来科幻场景中,同时保持人物姿态、光影及细节的完美融合。

  • VIDEO 3.0 Omni (视频多模态优化): 针对视频素材,该功能解决了绿幕拍摄成本高、场景受限的痛点。创作者无需重新拍摄,即可通过自然语言指令移除不需要的背景干扰(如路人、杂物),并替换为自定义背景。系统能够智能保留主体的运动轨迹、摄像机视角及原始动作,确保视频在背景切换后依然流畅自然。

技术亮点与实用价值

1. 高分辨率输出支持

IMAGE 3.0 Omni 原生支持 2K 和 4K 分辨率输出。这一技术指标对于电商产品图、广告素材及高质量视频制作至关重要,确保了主体在放大或高清播放时,边缘清晰、细节无损。

2. 提示词驱动的创作自由度

不同于传统工具依赖自动检测,可灵 AI 允许用户通过Prompt-based editing 精确控制背景风格。无论是要求“复古胶片质感”还是“赛博朋克霓虹”,用户都能通过文字描述直接定义最终画面的视觉方向,大幅降低了专业后期制作的门槛。

3. 跨模态的无缝衔接

无论是静态图像还是动态视频,可灵 AI 都提供了一致的交互逻辑。这种统一的工作流使得创作者可以在同一个界面内完成从素材处理到场景生成的全过程,极大提升了生产效率。

行业影响与展望

可灵 AI 的这一更新,使其在背景移除工具市场中脱颖而出。相比于 Leonardo 侧重于 API 集成与资产处理,Canva 侧重于设计布局,以及 CapCut 侧重于短视频剪辑,可灵 AI 填补了“高保真场景重构” 这一关键空白。

对于开发者而言,这一功能意味着可以构建更智能的视觉增强应用;对于内容创作者,它意味着无需昂贵的绿幕设备即可实现无限的场景想象。正如官方所强调的,这不仅仅是移除背景,更是将现有的图像或视频转化为更完整的视觉场景。

随着 IMAGE 3.0 Omni 和 VIDEO 3.0 Omni 的上线,可灵 AI 正逐步确立其在 AI 视频与图像生成领域的领先地位,为用户带来更具创造力的技术体验。

“This makes Kling especially useful when the goal is not simply to erase a background, but to turn an existing image or video into a more complete visual scene.”

— Kling AI Official Blog

同主题深度资讯

查看更多 →
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
AI 工具 2026-09-24

美图 AI PPT 发布全新 Print-On-Demand 设计工作流,从创意到成品一键生成

美图 AI PPT 正式推出针对按需打印(POD)场景的专业设计解决方案,填补了通用 AI 绘图在商业落地环节的空白。该工具不仅提供从创意到样品的全链路生成能力,更内置了针对 T 恤、马克杯等实体产品的尺寸适配、安全区域预留及色彩对比度优化算法。开发者与创作者可利用其‘AI 辅助概念生成’功能,快速将模糊想法转化为符合印刷标准的可编辑矢量文件,大幅降低 POD 产品的试错成本。

美图AI PPT官方 / ADK编译 4 分钟
image · 免费+付费
★ 5.0 · 120评测
�

可灵AI

快手推出的AI图像和视频创作平台

可灵AI是快手推出的AI图像和AI视频创作平台,提供网页版和手机APP。支持AI图片和AI视频生成功能,AI图片生成支持文生图和图生图,用户可以输入描述或上传图片,AI据此生成新的图片。AI视频生成能将文本或图片转化为生动视频,具备视频延长和高清画质升级特性。用户能自定义首尾帧生成视频,享受丰富的视频编辑功能,如多种镜头控制选项。提供了多人协同创作的平台,支持最多5人同时在一个画布内进行创作,实现素材共享、实时联动和一键导出,通过“灵动画布”,创作者可以将零散的创意想法转化为文本、图像或视频节点,高效串联成完整的视觉作品。 可灵AI最新上线的AI数字人功能,支持用户上传一张角色图片和一段文字或音频,能生成高清数字人视频,基于Transformer的DiT架构,能实现口型精准同步与情绪动作精细控制,支持多种角色和语言,画质1080p,帧率48FPS,成本低至0.12元/秒。 可灵数字人 2.0 已正式上线,只需三步,上传角色图、添加配音、描述表现,即可生成表现力十足的数字人视频。此次升级支持手部和口型精准控制,单次生成最长可达 5 分钟,知识讲解和表演都能生动呈现。

查看 可灵AI 使用教程与功能