献丑 AI 接入腾讯混元全景 2.0:一句话生成无缝 720° 沉浸式世界
献丑 AI 今日宣布重大更新,正式接入腾讯混元团队于 2026 年 4 月开源的 HY-Pano 2.0 全景图生成模型。作为业界首个基于“世界模型”理念的全景生成方案,HY-Pano 2.0 彻底改变了 AI 生成 720° 沉浸式场景的方式,让创作者只需一句话或一张图,即可构建几何正确、无缝拼接的虚拟世界。
🌍 什么是 HY-Pano 2.0?
HY-Pano 2.0 并非简单的宽幅图拉伸,而是源自 HY-World 2.0(多模态 3D 世界模型)管线的核心组件。它采用 等距柱状投影(Equirectangular Projection, ERP),覆盖完整的 720° 视场,具备以下核心优势:
- 端到端隐式学习:无需相机参数或多视图拼接,直接从文本或单图输出完整全景。
- 几何与语义一致性:深刻理解空间结构,水面、建筑、植被的透视关系自然合理。
- 物理级无缝拼接:通过潜空间环形填充(Circle Padding)与像素混合,彻底消除左右边缘接缝。
- 3D 世界初始化:输出的全景图可直接作为 3D 场景的起点,无缝接入 Unity/UE5 等引擎。
🎨 画布工作流:三种全景创作路径
献丑 AI 在画布中新增 全景节点,支持三种灵活创作模式:
-
文生全景 (Text-to-Panorama)
- 操作:输入提示词,如“星空下的雪山湖畔,水面倒映银河”。
- 价值:从零构建奇幻、太空或超现实场景,无需素材。
-
图生全景 (Image-to-Panorama)
- 操作:上传普通横/竖构图图片,AI 自适应扩展为 720° 全景。
- 价值:将实景照片或概念图瞬间转化为可漫游的沉浸式空间。
-
上传已有全景 (Bring Your Own Panorama)
- 操作:上传 2:1 比例的 ERP 全景图(如 Insta720 拍摄或 Blender 渲染)。
- 价值:复用专业设备素材,直接在画布内查看、旋转、截图。
🔭 全景查看器:原生 WebGL 沉浸式体验
生成完成后,内置的 全景查看器 基于 Three.js + WebGL 构建,无需插件:
- 自由漫游:鼠标拖拽旋转,滚轮缩放细节。
- 自动巡游:一键开启自动旋转,适合演示展示。
- 方向截图:一键导出前/后/左/右视角,为后续视频制作提供精准素材。
🎬 解决 AI 视频“场景一致性”痛点
HY-Pano 2.0 的核心价值在于它是 AI 视频场景一致性的终极锚点。
传统 AI 视频生成常面临跨镜头空间错乱、光线材质漂移的问题。而献丑 AI 的工作流提供了全新的解决方案:
- 定锚:生成一张 720° 全景图,锁定整个场景的几何布局、光线方向与材质风格。
- 切片:利用全景查看器的 方向截图 功能,从同一空间提取多个角度的视角。
- 生成:将截图作为输入,通过 图生视频 节点生成连贯镜头。
效果对比:
- 传统方式:每镜独立生成,需反复抽卡凑合,成本高昂且易出错。
- 全景工作流:一张全景搞定整场环境,所有镜头天然对齐,实现真正的“一镜到底”。
🚀 应用场景展望
- 虚拟看房/元宇宙:快速搭建可漫游的虚拟样板间或游戏场景。
- 影视分镜:导演用全景预演场景氛围,统一多机位拍摄基调。
- 沉浸式艺术:将概念画转化为可拖拽探索的数字展览作品。
- 商业展示:低成本生成门店、展厅的虚拟漫游内容。
献丑 AI 感谢腾讯混元团队的开源贡献,将持续将前沿模型引入工作流,赋能创作者构建更真实的数字世界。