会懂网AI资讯获悉,9月1日,影眸科技正式发布世界生成模型Hyper3D WorldGen。用户上传一张场景图片,系统即可自动识别主要物体并生成独立3D资产,同时重构物体之间的物理关系——谁支撑谁、谁悬挂于谁,最终输出一个包含独立物体、空间关系与物理约束的完整3D场景。
WorldGen基于影眸自研的CAST架构,该研究于2025年斩获SIGGRAPH最佳论文。CAST的核心是从单张图片中补全被遮挡物体的三维结构,判断物体间的接触、支撑、悬挂关系。团队表示,模型采用网格与3D高斯混合表达,最快4秒即可生成一个可用资产。
据影眸科技联合创始人兼CTO张启煊透露,CAST研究完成后产品化仍用了约一年时间,从研究到产品历时约一年。原因在于”即使每个模块成功率都很高,级联后的整体成功率也会显著下降”——团队主要解决的就是多模块级联的错误累积问题,这也是3D生成从”实验室可行”到”产线可用”的真实工程门槛。

商业化落地层面,WorldGen已进入多个垂直行业。具身智能方向,影眸此前联合地瓜机器人、谋先飞发布”具身智能可训练仿真闭环方案”;影视方向,WorldGen与Seedance 2.5等视频生成模型形成”3D场景+视频生成”工作流;此外还面向游戏开发、XR与空间计算,可接入Isaac Sim、Blender、虚幻引擎等管线。
影眸科技创始人兼CEO吴迪表示,3D生成的赛道正在收敛,最终只有少数真正解决产业问题的团队能留在牌桌上。张启煊则强调,WorldGen是通用产品,并非为某个单一行业开发,场景生成同时对应游戏、XR、视频生成和机器人仿真等需求。





























暂无评论内容