可灵 AI 发布 IMAGE 3.0:多参考图一致性与精细化编辑能力全面升级

ADK 可灵AI官方 / ADK编译 2026-09-28 4 分钟 139 次浏览
速览导读 / Summary

可灵 AI 正式推出 IMAGE 3.0 版本,大幅提升了从文本到图像及图像到图像的生成质量。新版本支持同时参考多达 10 张参考图以保持角色与风格一致性,并引入自然语言指令进行精细化局部调整。开发者与创作者可借此实现更可控的创作流程,减少反复重绘,提升从草图到成品的效率。

参考图数量 10 张 多参考图一致性保持上限
编辑方式 自然语言指令 支持对构图、光影、材质等细节进行微调
模型版本 IMAGE 3.0 核心视觉生成模型迭代

Key Insights / 核心看点

  • 1 支持同时参考多达 10 张图像,显著提升角色与风格的一致性保持能力。
  • 2 引入自然语言指令进行精细化局部编辑,实现非破坏性的迭代优化。
  • 3 优化了从草图到成品的创作工作流,大幅降低专业级图像制作门槛。
  • 4 提供灵活的 API 接口与参数控制,赋能开发者构建定制化视觉应用。

可灵 AI 发布 IMAGE 3.0:多参考图一致性与精细化编辑能力全面升级

在 AIGC 创作领域,如何平衡“创意自由”与“细节控制”一直是核心挑战。近日,可灵 AI(Kling AI)发布了其最新的 IMAGE 3.0 模型更新,针对这一痛点进行了深度优化。该版本不仅强化了文本到图像(Text-to-Image)的生成能力,更在图像到图像(Image-to-Image)的参考保持与精细化编辑方面取得了突破性进展。

核心突破:从单图参考到多图一致性

IMAGE 3.0 最显著的技术升级在于其多参考图一致性保持能力。以往,用户往往受限于单张参考图,难以在保持角色特征、色彩风格或构图逻辑的同时,探索全新的场景或动作。现在,IMAGE 3.0 支持同时解析并融合多达 10 张参考图像的视觉特征。

这一架构层面的改进意味着,创作者可以上传多张不同视角、不同状态的角色图或产品图,让模型在生成新画面时,精准提取并保留关键视觉元素(如服装纹理、面部特征、产品型号等),同时自由变换背景、光影或镜头角度。这对于角色设计、IP 衍生图创作及电商产品渲染具有极高的实用价值。

精细化编辑:自然语言驱动的迭代工作流

除了生成质量的提升,IMAGE 3.0 还重构了用户的交互逻辑,引入了基于自然语言的精细化编辑(Refinement)机制。

  • 局部控制:用户无需重新生成整张图,只需通过自然语言指令(如“将前景的机器人肩膀展示得更清晰”或“将背景色调调整为深蓝色”),即可对特定区域进行微调。
  • 渐进式创作:系统支持在生成结果与预期不符时,通过多轮对话式指令逐步修正,而非推翻重来。这种“生成 - 反馈 - 微调”的闭环,极大地降低了专业级图像制作的门槛。

实际应用价值

对于开发者而言,IMAGE 3.0 提供了更丰富的 API 接口与参数控制,便于构建定制化的图像生成应用。对于普通用户,其直观的“上传参考 - 描述意图 - 微调优化”流程,使得无需设计背景也能产出高质量视觉内容成为可能。

正如可灵 AI 团队在更新中所述,该版本旨在“将图像创作与优化整合到一个灵活的流程中”,让用户能够随着创意的发展,利用自然语言指令持续塑造最终成果。

关键指标与亮点

指标项 数值/描述 价值说明
参考图上限 10 张 大幅提升多角色/多元素场景的一致性保持能力
编辑粒度 自然语言指令 支持对构图、光影、材质等细节进行非破坏性微调
适用场景 角色设计、产品渲染、故事板 覆盖从草图到成品的全链路创作需求

IMAGE 3.0 的发布标志着可灵 AI 在视觉生成领域进一步向“可控性”与“智能化”迈进,为构建更高效的 AI 视觉工作流奠定了坚实基础。

“Kling IMAGE 3.0 brings image creation and refinement into one flexible workflow. You can start with a written idea or visual references, then continue shaping the result with natural-language instructions as your creative direction develops.”

— 可灵 AI 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟
image · 免费+付费
★ 5.0 · 120评测
�

可灵AI

快手推出的AI图像和视频创作平台

可灵AI是快手推出的AI图像和AI视频创作平台,提供网页版和手机APP。支持AI图片和AI视频生成功能,AI图片生成支持文生图和图生图,用户可以输入描述或上传图片,AI据此生成新的图片。AI视频生成能将文本或图片转化为生动视频,具备视频延长和高清画质升级特性。用户能自定义首尾帧生成视频,享受丰富的视频编辑功能,如多种镜头控制选项。提供了多人协同创作的平台,支持最多5人同时在一个画布内进行创作,实现素材共享、实时联动和一键导出,通过“灵动画布”,创作者可以将零散的创意想法转化为文本、图像或视频节点,高效串联成完整的视觉作品。 可灵AI最新上线的AI数字人功能,支持用户上传一张角色图片和一段文字或音频,能生成高清数字人视频,基于Transformer的DiT架构,能实现口型精准同步与情绪动作精细控制,支持多种角色和语言,画质1080p,帧率48FPS,成本低至0.12元/秒。 可灵数字人 2.0 已正式上线,只需三步,上传角色图、添加配音、描述表现,即可生成表现力十足的数字人视频。此次升级支持手部和口型精准控制,单次生成最长可达 5 分钟,知识讲解和表演都能生动呈现。

查看 可灵AI 使用教程与功能