HeyGen 2026 七月更新:Video Podcast 与 30 分钟长视频模型发布
HeyGen 在 2026 年 7 月带来了里程碑式的更新,重点聚焦于长视频生成能力的突破与视频生产流程的自动化。此次更新不仅将核心框架 HyperFrames 深度整合进 Video Agent,还推出了全新的 Video Podcast 应用,彻底改变了内容创作者的生产方式。
核心突破:Video Podcast 与双主播演室
HeyGen 正式推出 Video Podcast 应用,这是一个能够根据脚本、URL、PDF 或主题,在几分钟内生成双主播视频播客的工具。
- 真实演播室体验:不同于简单的音频加波形,Video Podcast 为两位 AI 主持人构建了真实的演播室场景。系统自动处理多机位切换,包括广角建立镜头、单人特写以及对话间的 B-roll(空镜)插入,确保视频质感如同专业制作。
- 灵活协作:用户可在渲染前编辑脚本,系统会自动更新语音。更有趣的是,用户甚至可以通过电子邮件邀请真实的共同主持人,对方将使用自己的 Avatar 加入录制,无需注册 HeyGen 账号。
- 价值:解决了传统视频播客需要演播室、排期和第二人的痛点,让单兵作战也能产出高完成度的内容。
技术里程碑:30 分钟单通长视频模型
HeyGen 发布了业界最长的单通 AI 说话视频模型,支持在Avatar III、IV 和 V中生成长达30 分钟的连续视频。
- 解决一致性难题:以往模型在长视频中容易出现面部漂移或口型不同步的问题。新模型通过技术优化,确保在 30 分钟内面部特征、口型与声音始终保持高度一致。
- 无缝长内容生产:对于课程、培训模块或长解释类视频,用户只需输入一个脚本,即可输出一个完整的连续视频,无需再拼接多个短片段,彻底消除了剪辑痕迹。
HyperFrames 全面升级:从模板到代码生成
HyperFrames 框架现已成为 Video Agent 的核心组件,标志着 HeyGen 从“模板匹配”迈向了“代码生成”的新阶段。
- Figma 到视频 (Figma-to-Video):通过
/figma技能,Agent 可直接读取 Figma 链接,提取配色、字体和布局,自动生成与源文件 1:1 匹配的视频,设计师无需手动逐帧动画。 - 网站到视频 (Website-to-Video):输入 URL,Agent 自动抓取网站屏幕、字体和色彩,撰写故事并生成包含旁白和音乐的完整视频。
- KeyFrames 开源化:HeyGen 开源了类似 After Effects 的 GSAP 风格关键帧动画系统。开发者可通过
npx hyperframes keyframes命令查看并修正 Agent 的运动输出,或手动编辑,让专业级动画工作流对 AI 代理开放。 - Storyboard 预演模式:Agent 转变为“导演”角色,在渲染前提供 5 个角度方案、检查分镜图并绘制关键帧供用户审批,确保最终产出符合预期。
- 内置媒体库:集成了 10,000+ 音乐曲目、75,000+ 图片及音效,支持本地缓存,为项目提供版权安全且符合品牌调性的素材。
总结与展望
此次更新不仅大幅提升了 HeyGen 在长视频领域的技术天花板,更通过 HyperFrames 的自动化能力,将视频制作从“艺术创作”转变为“工程化流程”。对于开发者而言,这意味着更强大的 API 能力和更灵活的 Agent 工作流;对于内容创作者,则意味着以前需要团队协作的工作,现在可由单人快速完成。
“我们的目标不仅是生成视频,而是让视频创作像写代码一样简单且可控。” —— HeyGen 技术团队
开发者可立即在 app.heygen.com 体验 Video Agent 的新功能,或通过 npx hyperframes@latest skills 安装相关技能包。