献丑 AI 接入腾讯混元全景 2.0:一句话生成无缝 720° 沉浸式世界

ADK 献丑AI官方 / ADK编译 2026-04-17 5 分钟 117 次浏览
速览导读 / Summary

献丑 AI 正式接入腾讯混元开源的 HY-Pano 2.0 全景生成模型,推出画布工作流中的全景节点。用户可通过文生、图生或上传现有素材,一键生成几何正确、无缝拼接的 720° 等距柱状投影全景图。该功能不仅支持沉浸式预览,更作为解决 AI 视频场景一致性的核心锚点,实现从全景到多镜头连贯视频的自动化工作流。

模型版本 HY-Pano 2.0 腾讯混元开源,基于 HY-World 2.0 多模态 3D 世界模型架构
视场角 720° 覆盖完整等距柱状投影(ERP)全景
生成方式 Text-to-Panorama / Image-to-Panorama 支持纯文本描述或单图自适应扩展
技术特性 Circle Padding, Pixel Blending 潜空间环形填充与像素混合,确保物理级无缝拼接

Key Insights / 核心看点

  • 1 接入腾讯混元 HY-Pano 2.0,支持文生、图生及上传现有素材,一键生成几何正确的 720° 无缝全景图。
  • 2 内置原生 WebGL 全景查看器,支持自由漫游、自动旋转及多方向截图,无需插件即可沉浸式浏览。
  • 3 作为解决 AI 视频场景一致性的核心方案,通过‘全景定锚 + 方向切片 + 图生视频’工作流,实现多镜头空间与光影天然对齐。
  • 4 全景图可直接作为 3D 世界初始化入口,无缝衔接 Unity/UE5 等引擎,加速元宇宙与虚拟场景开发。

献丑 AI 接入腾讯混元全景 2.0:一句话生成无缝 720° 沉浸式世界

献丑 AI 今日宣布重大更新,正式接入腾讯混元团队于 2026 年 4 月开源的 HY-Pano 2.0 全景图生成模型。作为业界首个基于“世界模型”理念的全景生成方案,HY-Pano 2.0 彻底改变了 AI 生成 720° 沉浸式场景的方式,让创作者只需一句话或一张图,即可构建几何正确、无缝拼接的虚拟世界。

🌍 什么是 HY-Pano 2.0?

HY-Pano 2.0 并非简单的宽幅图拉伸,而是源自 HY-World 2.0(多模态 3D 世界模型)管线的核心组件。它采用 等距柱状投影(Equirectangular Projection, ERP),覆盖完整的 720° 视场,具备以下核心优势:

  • 端到端隐式学习:无需相机参数或多视图拼接,直接从文本或单图输出完整全景。
  • 几何与语义一致性:深刻理解空间结构,水面、建筑、植被的透视关系自然合理。
  • 物理级无缝拼接:通过潜空间环形填充(Circle Padding)与像素混合,彻底消除左右边缘接缝。
  • 3D 世界初始化:输出的全景图可直接作为 3D 场景的起点,无缝接入 Unity/UE5 等引擎。

🎨 画布工作流:三种全景创作路径

献丑 AI 在画布中新增 全景节点,支持三种灵活创作模式:

  1. 文生全景 (Text-to-Panorama)

    • 操作:输入提示词,如“星空下的雪山湖畔,水面倒映银河”。
    • 价值:从零构建奇幻、太空或超现实场景,无需素材。
  2. 图生全景 (Image-to-Panorama)

    • 操作:上传普通横/竖构图图片,AI 自适应扩展为 720° 全景。
    • 价值:将实景照片或概念图瞬间转化为可漫游的沉浸式空间。
  3. 上传已有全景 (Bring Your Own Panorama)

    • 操作:上传 2:1 比例的 ERP 全景图(如 Insta720 拍摄或 Blender 渲染)。
    • 价值:复用专业设备素材,直接在画布内查看、旋转、截图。

🔭 全景查看器:原生 WebGL 沉浸式体验

生成完成后,内置的 全景查看器 基于 Three.js + WebGL 构建,无需插件:

  • 自由漫游:鼠标拖拽旋转,滚轮缩放细节。
  • 自动巡游:一键开启自动旋转,适合演示展示。
  • 方向截图:一键导出前/后/左/右视角,为后续视频制作提供精准素材。

🎬 解决 AI 视频“场景一致性”痛点

HY-Pano 2.0 的核心价值在于它是 AI 视频场景一致性的终极锚点

传统 AI 视频生成常面临跨镜头空间错乱、光线材质漂移的问题。而献丑 AI 的工作流提供了全新的解决方案:

  1. 定锚:生成一张 720° 全景图,锁定整个场景的几何布局、光线方向与材质风格。
  2. 切片:利用全景查看器的 方向截图 功能,从同一空间提取多个角度的视角。
  3. 生成:将截图作为输入,通过 图生视频 节点生成连贯镜头。

效果对比

  • 传统方式:每镜独立生成,需反复抽卡凑合,成本高昂且易出错。
  • 全景工作流:一张全景搞定整场环境,所有镜头天然对齐,实现真正的“一镜到底”。

🚀 应用场景展望

  • 虚拟看房/元宇宙:快速搭建可漫游的虚拟样板间或游戏场景。
  • 影视分镜:导演用全景预演场景氛围,统一多机位拍摄基调。
  • 沉浸式艺术:将概念画转化为可拖拽探索的数字展览作品。
  • 商业展示:低成本生成门店、展厅的虚拟漫游内容。

献丑 AI 感谢腾讯混元团队的开源贡献,将持续将前沿模型引入工作流,赋能创作者构建更真实的数字世界。

👉 立即体验全景功能 👉 查看开源仓库

全景,是从 2D 图像通往 3D 世界的入口。选全景模型,看的不是分辨率,是它有没有'3D 世界观'。

献丑 AI 官方团队

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
AI 工具 2026-09-08

Accio Work 2026 安全剃须刀刀片评测指南发布:覆盖敏感肌与硬茬胡须的全场景解决方案

Accio Work 于 2026 年 9 月发布最新评测指南,针对 2026 年湿剃市场的演变,深度解析了 8 款最佳安全剃须刀刀片。指南涵盖从 Astra Superior Platinum 的全能王者到 Feather Hi-Stainless 的极致锋利,特别强调了针对敏感肌肤(如 Derby Extra Super Stainless)和环保需求(如 Personna Lab Blue)的专项解决方案,为不同肤质与胡须类型的用户提供精准选型建议。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 发布厨房研磨工具智能指南:材料选择与性能优化解析

Accio Work 发布了一篇关于研磨钵(Mortar and Pestle)最佳材料选择的深度指南。文章详细对比了花岗岩、大理石、陶瓷、木材及不锈钢等主流材质在研磨性能、耐用性、维护难度及美学风格上的差异。该指南旨在帮助消费者及零售商根据烹饪需求(如香料粉碎、酱汁制作)做出精准决策,体现了 Accio Work 在垂直领域知识库构建与搜索优化方面的技术实力。

Accio Work官方 / ADK编译 3 分钟
AI 工具 2026-09-08

Accio Work 2026 年迷你喷射快艇设计趋势:电动化与模块化重塑水上运动

Accio Work 发布 2026 年迷你喷射快艇设计趋势报告,展示了 9 款重新定义水上运动的新概念。核心亮点包括革命性的充气式电动快艇、热插拔电池系统的通勤者设计、以及专为家庭安全优化的模块化构建方案。这些设计利用先进复合材料与零排放电动动力,解决了传统水上运动便携性差、续航焦虑及安全性不足的问题,为个人娱乐与商业租赁市场提供了全新灵感。

Accio Work官方 / ADK编译 3 分钟
video · 免费+付费
★ 5.0 · 120评测

献丑AI

首个 AI 视频开源社区,支持一键Fork与共创

献丑AI是首个 AI 视频开源社区,也是专业级AI 视频创作工具。核心打破 AI 视频创作的信息壁垒,公开作品的提示词、模型参数等完整创作流程,支持一键复用(Fork)与共创;搭载无限画布工作流,可在单一平台完成从脚本构思到视频合成的全流程操作,无需切换多软件,兼具可视化、可调整、可积累的优势。覆盖电商、品牌营销、影视创作等多元场景,适配零基础新手至资深创作者,让每个人的理念可以结构化、精准视觉化呈现,构建有深度的创作者世界。

查看 献丑AI 使用教程与功能