可灵 AI 发布 IMAGE 3.0:精准控制照片转手绘,支持铅笔素描至水彩插画多风格迁移

ADK 可灵AI官方 / ADK编译 2026-09-18 4 分钟 153 次浏览
速览导读 / Summary

可灵 AI 推出 IMAGE 3.0 版本,大幅优化照片转手绘(Photo-to-Drawing)功能。该更新允许用户将任意照片精准转化为铅笔素描、线稿、彩色铅笔或水彩插画等多种风格,同时通过结构化提示词(Prompt)和参考图控制,在保留原图人物特征与构图的同时,实现艺术风格的自由迁移。

模型版本 IMAGE 3.0 核心视觉生成模型升级
支持风格数量 6+ 原生支持素描、线稿、水彩等多种手绘风格
功能特性 Photo-to-Drawing 新增照片转手绘的精细化控制能力

Key Insights / 核心看点

  • 1 IMAGE 3.0 大幅优化照片转手绘功能,支持从铅笔素描到水彩插画等多种风格的精准转换。
  • 2 引入结构化提示词机制,允许用户在风格化过程中保留原图的人物特征、构图及关键细节。
  • 3 提供多种手绘风格预设,涵盖草图、线稿、彩色铅笔、蜡笔及复古漫画等,满足不同创作需求。
  • 4 支持分步迭代与局部优化,帮助用户在保持主体一致性的前提下,灵活调整线条、阴影及背景。

可灵 AI 发布 IMAGE 3.0:精准控制照片转手绘

可灵 AI(Kling AI)近日更新了其核心视觉生成模型 IMAGE 3.0,重点强化了“照片转手绘”(Photo-to-Drawing)的能力。这一更新解决了以往 AI 绘图在风格化过程中容易丢失原图关键特征(如面部特征、构图比例)的痛点,为创作者提供了从写实照片到艺术插画的高质量转换方案。

核心突破:结构化提示词与风格控制

在 IMAGE 3.0 中,可灵 AI 引入了更精细的提示词工程逻辑。用户不再需要模糊的描述,而是可以通过明确的指令告诉模型保留哪些细节,并应用何种艺术风格。

1. 三大核心步骤

  • 上传参考图:上传一张主体清晰、细节可见的照片。模型将利用该图像作为视觉上下文(Visual Context),确保生成的画作在人物姿态、构图和关键物体上与原图保持一致。
  • 选择风格与撰写 Prompt:用户需在提示词中明确指定风格(如铅笔素描、线稿、水彩等),并列出需要保留的细节(如面部表情、发型、服装)。
  • 生成与迭代:生成初稿后,用户可根据反馈进行微调,专注于特定区域(如背景简化或线条优化)的修正。

2. 支持的艺术风格

IMAGE 3.0 原生支持多种手绘风格的转换,每种风格对线条、纹理和阴影的处理方式截然不同:

风格类型 视觉特征 适用场景
Doodle / 草图 线条松散,细节简化 快速记录灵感
Sketch (素描) 可见线条,轻度阴影 艺术练习
Colored Pencil 分层上色,铅笔质感 插画创作
Crayon 笔触粗犷,手工感强 儿童插画风格
Watercolor 边缘柔和,色彩流动 浪漫风格插画
Retro Comic 强轮廓,图形化风格 复古漫画

3. 提示词(Prompt)编写指南

为了获得最佳效果,建议 Prompt 包含以下四个维度:

  1. Drawing Style:明确媒介,例如 "graphite pencil sketch" 或 "clean line art"。
  2. Details to Preserve:指定需保留的关键特征,如 "facial features, hairstyle, pose"。
  3. Visual Characteristics:描述纹理细节,如 "fine cross-hatching", "soft watercolor edges"。
  4. Background Treatment:说明背景处理,如 "simplify background" 或 "remove background"。

实际应用价值

对于设计师、插画师及内容创作者而言,IMAGE 3.0 提供了强大的工作流工具:

  • 快速风格迁移:无需重新拍摄,即可将生活照瞬间转化为专业级的手绘作品。
  • 特征保留机制:相比旧版模型,IMAGE 3.0 在大幅风格化时能更好地维持原图主体的辨识度,避免“换脸”或变形。
  • 灵活迭代:支持针对特定区域(如仅调整阴影或线条粗细)进行局部优化,提升创作效率。

示例 Prompt

目标:将照片转换为铅笔素描 Prompt: Convert this photo into a graphite pencil sketch. Keep the facial features, hairstyle, pose, and overall composition recognizable. Use fine pencil strokes, light cross-hatching, soft graphite shading, and subtle textured paper.

可灵 AI 此次更新标志着其在图像生成领域的精细化程度迈上新台阶,不仅提升了生成质量,更赋予了用户更深层的创作控制权。

“Turning a favorite photo into a pencil sketch or illustration sounds simple, but strong stylization can change the features that made the original image recognizable. A clear reference and specific visual instructions give the model a stronger direction.”

— Kling AI 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
AI 工具 2026-09-24

美图 AI PPT 发布全新 Print-On-Demand 设计工作流,从创意到成品一键生成

美图 AI PPT 正式推出针对按需打印(POD)场景的专业设计解决方案,填补了通用 AI 绘图在商业落地环节的空白。该工具不仅提供从创意到样品的全链路生成能力,更内置了针对 T 恤、马克杯等实体产品的尺寸适配、安全区域预留及色彩对比度优化算法。开发者与创作者可利用其‘AI 辅助概念生成’功能,快速将模糊想法转化为符合印刷标准的可编辑矢量文件,大幅降低 POD 产品的试错成本。

美图AI PPT官方 / ADK编译 4 分钟
image · 免费+付费
★ 5.0 · 120评测
�

可灵AI

快手推出的AI图像和视频创作平台

可灵AI是快手推出的AI图像和AI视频创作平台,提供网页版和手机APP。支持AI图片和AI视频生成功能,AI图片生成支持文生图和图生图,用户可以输入描述或上传图片,AI据此生成新的图片。AI视频生成能将文本或图片转化为生动视频,具备视频延长和高清画质升级特性。用户能自定义首尾帧生成视频,享受丰富的视频编辑功能,如多种镜头控制选项。提供了多人协同创作的平台,支持最多5人同时在一个画布内进行创作,实现素材共享、实时联动和一键导出,通过“灵动画布”,创作者可以将零散的创意想法转化为文本、图像或视频节点,高效串联成完整的视觉作品。 可灵AI最新上线的AI数字人功能,支持用户上传一张角色图片和一段文字或音频,能生成高清数字人视频,基于Transformer的DiT架构,能实现口型精准同步与情绪动作精细控制,支持多种角色和语言,画质1080p,帧率48FPS,成本低至0.12元/秒。 可灵数字人 2.0 已正式上线,只需三步,上传角色图、添加配音、描述表现,即可生成表现力十足的数字人视频。此次升级支持手部和口型精准控制,单次生成最长可达 5 分钟,知识讲解和表演都能生动呈现。

查看 可灵AI 使用教程与功能