可灵 AI 发布 IMAGE 3.0 Omni 与 VIDEO 3.0 Omni:重塑背景编辑新范式
在 AI 图像与视频生成领域,背景处理一直是制约内容创作效率的关键环节。传统的抠图工具往往止步于提供透明背景,难以满足现代创作者对场景融合、风格迁移及动态视频编辑的复杂需求。近日,可灵 AI (Kling AI) 在其官方博客中重点展示了其最新的核心能力升级——IMAGE 3.0 Omni 与 VIDEO 3.0 Omni,标志着其背景编辑工具从“减法”(移除背景)向“加法”(场景重构)的跨越。
核心突破:从透明抠图到场景重构
可灵 AI 此次更新的核心逻辑在于重新定义“背景移除”的价值。它不再仅仅是一个去除杂质的工具,而是成为了一个创意工作流 (Creative Workflow) 的起点。
-
IMAGE 3.0 Omni (图像多模态优化): 该功能不仅支持将主体从原图中分离出透明背景,更具备强大的场景重建能力。用户只需输入自然语言提示词 (Prompts) 或上传参考图像,即可让主体置身于全新的环境中。例如,将一位模特从办公室背景中移除,并瞬间“放置”在巴黎街头或未来科幻场景中,同时保持人物姿态、光影及细节的完美融合。
-
VIDEO 3.0 Omni (视频多模态优化): 针对视频素材,该功能解决了绿幕拍摄成本高、场景受限的痛点。创作者无需重新拍摄,即可通过自然语言指令移除不需要的背景干扰(如路人、杂物),并替换为自定义背景。系统能够智能保留主体的运动轨迹、摄像机视角及原始动作,确保视频在背景切换后依然流畅自然。
技术亮点与实用价值
1. 高分辨率输出支持
IMAGE 3.0 Omni 原生支持 2K 和 4K 分辨率输出。这一技术指标对于电商产品图、广告素材及高质量视频制作至关重要,确保了主体在放大或高清播放时,边缘清晰、细节无损。
2. 提示词驱动的创作自由度
不同于传统工具依赖自动检测,可灵 AI 允许用户通过Prompt-based editing 精确控制背景风格。无论是要求“复古胶片质感”还是“赛博朋克霓虹”,用户都能通过文字描述直接定义最终画面的视觉方向,大幅降低了专业后期制作的门槛。
3. 跨模态的无缝衔接
无论是静态图像还是动态视频,可灵 AI 都提供了一致的交互逻辑。这种统一的工作流使得创作者可以在同一个界面内完成从素材处理到场景生成的全过程,极大提升了生产效率。
行业影响与展望
可灵 AI 的这一更新,使其在背景移除工具市场中脱颖而出。相比于 Leonardo 侧重于 API 集成与资产处理,Canva 侧重于设计布局,以及 CapCut 侧重于短视频剪辑,可灵 AI 填补了“高保真场景重构” 这一关键空白。
对于开发者而言,这一功能意味着可以构建更智能的视觉增强应用;对于内容创作者,它意味着无需昂贵的绿幕设备即可实现无限的场景想象。正如官方所强调的,这不仅仅是移除背景,更是将现有的图像或视频转化为更完整的视觉场景。
随着 IMAGE 3.0 Omni 和 VIDEO 3.0 Omni 的上线,可灵 AI 正逐步确立其在 AI 视频与图像生成领域的领先地位,为用户带来更具创造力的技术体验。