HeyGen 发布 Avatar IV/V 自定义动作提示:实现更自然的微表情与手势控制

ADK HeyGen官方 / ADK编译 2026-08-28 4 分钟 55 次浏览
速览导读 / Summary

HeyGen 正式升级 Avatar IV 与 Avatar V 引擎,引入基于自然语言描述的‘自定义动作提示(Custom Motion Prompts)’功能。用户可通过简短指令精确控制面部表情、手部手势及视线方向,无需繁琐预设。该功能支持单动作描述,最长生成 10 秒,显著提升了虚拟主播在短视频场景中的表现力与真实感。

引擎版本 Avatar IV & V 支持自定义动作提示
单次生成时长 10 秒 自定义动作提示的最大有效时长
控制维度 表情 + 手势 + 视线 + 姿态 覆盖虚拟人微表情与肢体语言

Key Insights / 核心看点

  • 1 引入自然语言驱动的 Custom Motion Prompts,支持通过简短文本指令精确控制虚拟人的表情、手势和视线。
  • 2 Avatar V 新增结构化预设(表情/手势/视线),可与自定义文本指令结合使用,实现更精细的微调。
  • 3 明确功能边界,仅控制面部与肢体微动作,不支持场景切换、相机运动或道具交互。
  • 4 提供最佳实践指南,建议单次生成不超过 10 秒,并推荐在长视频中交替使用默认运动与自定义动作以避免循环感。

HeyGen 发布 Avatar IV/V 自定义动作提示:实现更自然的微表情与手势控制

HeyGen 近日在其官方博客宣布,针对 Avatar IV 和 Avatar V 引擎推出了全新的自定义动作提示(Custom Motion Prompts)功能。这一更新旨在赋予创作者更精细的虚拟人控制能力,通过自然语言描述来驱动虚拟角色的面部表情、肢体语言及视线变化,从而制作出更具动态感和真实感的视频内容。

核心突破:从预设到自然语言驱动

此次更新的核心在于将传统的结构化预设(Preset)扩展为灵活的文本指令系统。

  • Avatar IV 的进化:支持基于脚本的场景化动作渲染。用户只需输入自然语言描述(如"右臂抬起挥手,热情友好"),系统即可解析并生成相应的动作。虽然功能强大,但受限于单次生成的时长。
  • Avatar V 的增强:在保留自然语言控制的同时,引入了专门的Expression(表情)Gesture(手势)Gaze(视线)预设标签。用户可以在这些结构化选项基础上,叠加自定义文本指令,实现更精准的微调。

可控维度与边界

HeyGen 明确了自定义动作提示的控制边界,确保用户理解其适用范围:

✅ 可控制维度

  • 面部表情 (Facial Expression):包括平静、热情、严肃、温暖、自信、真诚、悲伤、强烈等情绪状态。
  • 手部手势 (Hand Gestures):涵盖挥手、指点、竖大拇指、手捂胸口、和平手势、交叉双臂、OK 手势、合十礼、张开双臂、握拳、敬礼、鼓掌、耸肩等。
  • 身体姿态 (Body Posture):如前倾、稳重、开放温暖、端庄等。
  • 视线方向 (Gaze):直视镜头、移开视线、看向侧方。
  • 静止状态 (Stillness):控制手部是否完全静止或减少动作幅度。

❌ 不可控制维度

值得注意的是,该功能不包含场景级控制。用户无法通过此功能控制:

  • 相机运动(推拉摇移)
  • 场景切换或位置移动(如走到厨房、走出房间)
  • 道具交互(喝咖啡、吸烟、拿手机)
  • 起立、行走或背景/灯光变化

这些功能需在 HeyGen 编辑器中的其他模块单独配置。

最佳实践:如何编写高效的 Motion Prompt

为了获得最自然的动画效果,HeyGen 提供了具体的编写指南:

  1. 结构清晰:遵循 [身体部位] + [动作] + [情绪/强度] 的公式。
    • 示例:"Avatar smiles softly while raising a hand."
  2. 保持简洁:每个提示词最好只描述一个主要手势或情绪。虽然可以组合短句(如"点头然后指向前方"),但避免堆砌过多动作会导致生成不稳定。
  3. 利用 Avatar V 预设:在 Avatar V 中,可以先选择预设的表情或手势标签,再辅以简短的文本指令进行微调。
  4. 注意时长限制:自定义动作提示的最大生成时长为 10 秒。若应用于长场景,系统会对前 10 秒生成动作,其余部分可能循环或静止。
    • 技巧:对于长视频,建议主体部分使用默认运动,仅在需要强调特定动作时插入 10 秒的自定义提示,以避免循环感。

技术价值与应用场景

这一更新标志着 HeyGen 在Fine-tuningPrompt Engineering领域的进一步深耕。通过理解自然语言中的细微差别(如"warm and open"vs"composed"),模型能够输出更细腻的微表情和肢体语言。

对于开发者而言,这为构建更智能的虚拟数字人提供了新的 API 交互范式;对于内容创作者,这意味着无需复杂的动作捕捉设备,仅凭文字描述即可实现专业级的虚拟表演效果,极大地降低了高质量虚拟视频的生产门槛。

官方引言:"Properly setting your motion prompts brings your Avatar IV & Avatar V creations to life by giving you more control over expression." —— HeyGen 官方团队

通过这一功能,HeyGen 继续巩固其作为全球领先 AI 视频生成工具的地位,让虚拟人的每一次‘表演’都更加生动自然。

"Properly setting your motion prompts brings your Avatar IV & Avatar V creations to life by giving you more control over expression."

HeyGen 官方团队

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
video · 免费+付费
★ 5.0 · 120评测
H

HeyGen

专业的AI数字人视频创作平台

HeyGen是全球领先的AI数字人视频创作平台,致力于简化视频制作过程,让用户能迅速制作出具有专业水准的数字人视频。HeyGen能将文本、图像或音频快速转化为高质量视频,基于视频创作Agent,能实现从创意构思到成品视频的一站式制作,HeyGen支持多语言语音克隆、AI 字幕生成等功能,极大简化视频创作流程,降低时间和成本。

查看 HeyGen 使用教程与功能