献丑 AI 接入腾讯混元全景 2.0:一句话生成无缝 720° 沉浸式世界

ADK 献丑AI官方 / ADK编译 2026-04-17 5 分钟 117 次浏览
速览导读 / Summary

献丑 AI 正式接入腾讯混元开源的 HY-Pano 2.0 全景生成模型,推出画布工作流中的全景节点。用户可通过文生、图生或上传现有素材,一键生成几何正确、无缝拼接的 720° 等距柱状投影全景图。该功能不仅支持沉浸式预览,更作为解决 AI 视频场景一致性的核心锚点,实现从全景到多镜头连贯视频的自动化工作流。

模型版本 HY-Pano 2.0 腾讯混元开源,基于 HY-World 2.0 多模态 3D 世界模型架构
视场角 720° 覆盖完整等距柱状投影(ERP)全景
生成方式 Text-to-Panorama / Image-to-Panorama 支持纯文本描述或单图自适应扩展
技术特性 Circle Padding, Pixel Blending 潜空间环形填充与像素混合,确保物理级无缝拼接

Key Insights / 核心看点

  • 1 接入腾讯混元 HY-Pano 2.0,支持文生、图生及上传现有素材,一键生成几何正确的 720° 无缝全景图。
  • 2 内置原生 WebGL 全景查看器,支持自由漫游、自动旋转及多方向截图,无需插件即可沉浸式浏览。
  • 3 作为解决 AI 视频场景一致性的核心方案,通过‘全景定锚 + 方向切片 + 图生视频’工作流,实现多镜头空间与光影天然对齐。
  • 4 全景图可直接作为 3D 世界初始化入口,无缝衔接 Unity/UE5 等引擎,加速元宇宙与虚拟场景开发。

献丑 AI 接入腾讯混元全景 2.0:一句话生成无缝 720° 沉浸式世界

献丑 AI 今日宣布重大更新,正式接入腾讯混元团队于 2026 年 4 月开源的 HY-Pano 2.0 全景图生成模型。作为业界首个基于“世界模型”理念的全景生成方案,HY-Pano 2.0 彻底改变了 AI 生成 720° 沉浸式场景的方式,让创作者只需一句话或一张图,即可构建几何正确、无缝拼接的虚拟世界。

🌍 什么是 HY-Pano 2.0?

HY-Pano 2.0 并非简单的宽幅图拉伸,而是源自 HY-World 2.0(多模态 3D 世界模型)管线的核心组件。它采用 等距柱状投影(Equirectangular Projection, ERP),覆盖完整的 720° 视场,具备以下核心优势:

  • 端到端隐式学习:无需相机参数或多视图拼接,直接从文本或单图输出完整全景。
  • 几何与语义一致性:深刻理解空间结构,水面、建筑、植被的透视关系自然合理。
  • 物理级无缝拼接:通过潜空间环形填充(Circle Padding)与像素混合,彻底消除左右边缘接缝。
  • 3D 世界初始化:输出的全景图可直接作为 3D 场景的起点,无缝接入 Unity/UE5 等引擎。

🎨 画布工作流:三种全景创作路径

献丑 AI 在画布中新增 全景节点,支持三种灵活创作模式:

  1. 文生全景 (Text-to-Panorama)

    • 操作:输入提示词,如“星空下的雪山湖畔,水面倒映银河”。
    • 价值:从零构建奇幻、太空或超现实场景,无需素材。
  2. 图生全景 (Image-to-Panorama)

    • 操作:上传普通横/竖构图图片,AI 自适应扩展为 720° 全景。
    • 价值:将实景照片或概念图瞬间转化为可漫游的沉浸式空间。
  3. 上传已有全景 (Bring Your Own Panorama)

    • 操作:上传 2:1 比例的 ERP 全景图(如 Insta720 拍摄或 Blender 渲染)。
    • 价值:复用专业设备素材,直接在画布内查看、旋转、截图。

🔭 全景查看器:原生 WebGL 沉浸式体验

生成完成后,内置的 全景查看器 基于 Three.js + WebGL 构建,无需插件:

  • 自由漫游:鼠标拖拽旋转,滚轮缩放细节。
  • 自动巡游:一键开启自动旋转,适合演示展示。
  • 方向截图:一键导出前/后/左/右视角,为后续视频制作提供精准素材。

🎬 解决 AI 视频“场景一致性”痛点

HY-Pano 2.0 的核心价值在于它是 AI 视频场景一致性的终极锚点

传统 AI 视频生成常面临跨镜头空间错乱、光线材质漂移的问题。而献丑 AI 的工作流提供了全新的解决方案:

  1. 定锚:生成一张 720° 全景图,锁定整个场景的几何布局、光线方向与材质风格。
  2. 切片:利用全景查看器的 方向截图 功能,从同一空间提取多个角度的视角。
  3. 生成:将截图作为输入,通过 图生视频 节点生成连贯镜头。

效果对比

  • 传统方式:每镜独立生成,需反复抽卡凑合,成本高昂且易出错。
  • 全景工作流:一张全景搞定整场环境,所有镜头天然对齐,实现真正的“一镜到底”。

🚀 应用场景展望

  • 虚拟看房/元宇宙:快速搭建可漫游的虚拟样板间或游戏场景。
  • 影视分镜:导演用全景预演场景氛围,统一多机位拍摄基调。
  • 沉浸式艺术:将概念画转化为可拖拽探索的数字展览作品。
  • 商业展示:低成本生成门店、展厅的虚拟漫游内容。

献丑 AI 感谢腾讯混元团队的开源贡献,将持续将前沿模型引入工作流,赋能创作者构建更真实的数字世界。

👉 立即体验全景功能 👉 查看开源仓库

全景,是从 2D 图像通往 3D 世界的入口。选全景模型,看的不是分辨率,是它有没有'3D 世界观'。

献丑 AI 官方团队

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
video · 免费+付费
★ 5.0 · 120评测

献丑AI

首个 AI 视频开源社区,支持一键Fork与共创

献丑AI是首个 AI 视频开源社区,也是专业级AI 视频创作工具。核心打破 AI 视频创作的信息壁垒,公开作品的提示词、模型参数等完整创作流程,支持一键复用(Fork)与共创;搭载无限画布工作流,可在单一平台完成从脚本构思到视频合成的全流程操作,无需切换多软件,兼具可视化、可调整、可积累的优势。覆盖电商、品牌营销、影视创作等多元场景,适配零基础新手至资深创作者,让每个人的理念可以结构化、精准视觉化呈现,构建有深度的创作者世界。

查看 献丑AI 使用教程与功能