在3D生成领域,原生三维模型的质量一直是衡量技术实力的核心标尺。刚刚过去的WAIC 2026上,3D生成成为最受关注的赛道之一,吸引了大量业内人士的目光。2026年6月,位于上海张江的影眸科技正式发布了最新一代3D生成大模型Hyper3D Rodin Gen-2.5,一举成为全球首个具备千万面级生成能力的3D大模型。
据《经济参考报》7月30日报道,影眸Hyper3D的研发支出占比高达60%至70%,核心模型均为自主研发训练。这家由1997年出生的吴迪在2020年创立的公司,最新一轮融资已于近日完成,将全部用于核心研发与市场拓展,加速适配更多的工业化专业建模场景。在WAIC 2026期间,影眸参与的具身智能可训练仿真闭环联合解决方案也正式发布,展示了从单张照片还原出包含物体关系和物理约束的可交互三维场景的能力,为机器人仿真训练提供了全新的低成本路径。这项应用将影眸的技术边界从数字内容创作延伸到了物理AI训练领域,开辟了全新的商业化方向。
影眸选择的技术路线与行业主流截然不同。当大多数3D生成公司依赖将多视角2D图像重建3D模型的升维路径时,影眸从创立之初就押注3D原生的技术路线,基于原创的CLAY框架直接训练三维大模型。这不仅仅是技术选择上的差异,更代表着对3D生成未来方向的根本性判断。事实证明这一判断是正确的,2024年影眸推出全球首个原生3D大模型产品后,直接引领了全行业的技术路径转向。
Rodin Gen-2.5最引人注目的创新是将思考深度调节机制引入3D生成领域,这在行业中尚属首次。用户可以根据实际需求灵活调节生成精度与细节:如果只需要快速预览概念模型,选择4秒生成模式即可获得一个百万面级的高质量模型;如果要用于影视级输出或工业设计验证,80秒深度思考模式则能把模型表面的纹路和微结构细节都生动展现出来。
这种设计思路反映了影眸对3D生成商业化场景的深刻理解。在游戏开发的前期概念阶段,快速迭代是核心需求,4秒出一版模型意味着设计师可以在短时间内尝试几十种设计方案。而在影视特效和高端工业设计场景中,模型质量和细节精度才是决定性因素,用户愿意等待80秒换取千倍级的面数提升。此外Rodin Gen-2.5还支持12K原生3D贴图输出,单张贴图分辨率达到12288乘12288像素,是当前主流4K贴图的9倍。在虚拟现实或超大屏幕场景中,12K贴图能够确保模型在近距离观察时依然保持纹理的清晰细腻。
在WAIC 2026的展台上,影眸的3D生成演示区吸引了大量专业观众。来自好莱坞的一位视觉特效总监在体验后表示Rodin Gen-2.5的生成质量已经接近可用的工业标准,尤其在毛发渲染和织物细节方面表现惊艳。这种来自一线从业者的评价,比任何技术指标都更有说服力。
影眸的技术根基可以追溯到上海科技大学的计算机图形学实验室。创始人吴迪在2016年加入学校相关课题组,研究方向是如何将现实世界中的物体精准建模还原到虚拟世界。2020年正在读研一的吴迪与其他几位在校生共同创立了影眸Hyper3D,创业之初团队平均年龄不到25岁。
当时的3D生成领域,主流技术长期依赖多视角2D图像重建3D模型的方式。这种方式在降维再升维的过程中必然伴随信息丢失,生成的模型表面往往凹凸不平需要大量时间进行二次修改。影眸团队选择了一条在当时看来几乎是孤注一掷的技术路线。吴迪回忆说团队在最困难的时期还是坚持把模型做了出来。基于影眸团队发布的原生3D大模型框架CLAY,影眸在2024年推出了全球首个原生3D大模型产品Hyper3D。从RODIN Gen-1到Gen-2再到Gen-2.5,影眸用三年时间完成了从技术验证到产品化再到商业化的完整闭环。
截至目前Hyper3D已获得大量海外市场订单,被广泛应用于游戏制作、影视特效及电商展示等专业领域。公司还在探索向工业设计领域延伸,助力汽车和家具等产品设计大幅缩减外观预览环节的试错时间。吴迪表示期待有一天3D生成会像手机拍照一样成为一项基础功能,个人用户也能轻松完成3D内容的创作。
在游戏制作领域,设计师用Hyper3D可以将传统需要数天的角色建模工作压缩到数十分钟。在影视特效领域,团队能够快速生成高精度的场景资产,大幅缩短前期筹备周期。在电商展示环节,卖家可以为每一件商品生成可全方位浏览的3D模型,显著提升转化率。
在刚刚结束的WAIC 2026上,影眸参与的具身智能可训练仿真闭环联合解决方案成为一大亮点。针对当前行业普遍面临的机器人仿真训练数据供给不足问题,影眸的世界生成模型可从单张照片还原出包含物体、物体关系和物理约束的可交互三维场景,批量用于机器人仿真训练。这意味着机器人在虚拟环境中就能完成抓取、行走、避障等动作的学习,无需依赖昂贵的真实场景部署。这项应用将影眸的技术边界从数字内容创作延伸到了物理AI训练领域。