新闻

一张图生成3D梦中情房,桌椅摆件随心换,又一世界生成模型来了

1 分钟阅读
来源:zhidx.com
智东西 作者 | 杨京丽 编辑 | 李水青 智东西9月1日报道,今天,上海3D生成大模型公司影眸科技发布 世界生成模型Hyper3D WorldGen ,推动3D生成从“单个资产”走向 “完整场景” 。 用户上传一张场景图片后,模型可以 自动识别画面中的主要物体 ,并生成对应的3D资产,也支持 手动框选目标生成 ,并通过影眸Hyper3D团队自研的CAST架构,重建物体之间的空间与物理关系,最终生成由多个独立、可编辑、可替换、可交互资产组成的3D场景。 CAST为“基于单张RGB图像的组件对齐式3D场景重建”,是影眸Hyper3D团队在2025年发布的场景级生成研究成果。其核心是从单张图片中 补全被遮挡物体的三维结构 ,判断物体之间的 接触、支撑、悬挂等关系 ,并将多个独立物体放入统一、物理合理的三维空间。该研究曾获SIGGRAPH 2025最佳论文。 值得注意的是,WorldGen的生成能力已经进入 具身智能仿真训练、影视制作、游戏开发与XR 等真实生产场景,推动场景级3D生成从视觉展示走向产业工作流。 模型发布前,智东西等媒体采访了影眸科技创始人、CEO吴迪和联合创始人、CTO张启煊,围绕WorldGen的技术路线、应用进展及3D生成行业趋势等问题进行了交流。 一、一张图片生成场景,场景内资产可交互 媒体交流会上,张启煊演示了WorldGen的生成过程:上传一张办公室盥洗室的图片后,系统能够自动识别水龙头、盘子、水果等主要物体,约2-3秒生成单个物体的3D预览,并在约2-3分钟内还原出完整场景。 这些物体都是可以被选择、移动和替换的独立资产。开启SimReady功能后,系统