行业资讯

国产UniWorld-View登顶李飞飞团队世界模型榜单 全开源适配昇腾

优秘智能观察:国产视觉AI技术再获突破,世界模型领域出现适配国产算力的开源方案,将大幅降低企业3D、视频内容生成的AI应用门槛。

登顶李飞飞团队世界模型榜单的国产方案有何不同?

李飞飞团队发布的WorldScore世界模型榜单近日更新榜首,登顶的是兔展智能联合北大、鹏城实验室研发的UniWorld-View,该模型已完成国产昇腾算力适配,训练数据来自北大系初创企业元空智能,代码与权重已全部开源

WorldScore世界模型榜单截图

该模型可实现单图/单目视频输入,生成任意指定相机轨迹的新视角内容,推、拉、摇、移、360°环绕等复杂视角控制均可精准实现,且单图3D生成、视频4D生成共用同一套模型架构,大幅降低了应用落地的复杂度。

两大技术突破解决视角生成行业痛点

新视角合成的行业核心难点在于「大基线生成」:仅提供物体正脸输入的前提下,要求AI生成侧脸、后脑勺等未拍摄到的角度,传统方案易出现伪影、结构扭曲、视角失控等问题。

UniWorld-View首先通过「遮挡感知点云渲染」技术解决了传统点云渲染的两大穿帮问题:

  • 双重投影方案:通过像素来回投影识别遮挡区域,生成遮挡mask剔除错误纹理,避免前景背景撕裂
  • 法向过滤方案:通过点云法向量与视线夹角判断,直接剔除背对相机的点,解决背面漏光问题
遮挡感知点云渲染技术原理示意图

在此基础上,模型采用「双流条件注入」架构实现内容质量与结构准确性的平衡:

  • 几何流:以点云渲染图+mask作为条件,控制生成内容贴合3D结构,保证构图准确
  • 外观流:通过Ref-DiT模块调取源视频素材补全缺失内容,保证生成内容与原素材风格一致
UniWorld-View模型框架示意图

依托上述能力,该模型可实现「单目随手拍→可自由视角漫游的4D场景」的全流程打通,降低了4D重建的落地门槛。

技术商业化落地加速 视觉AI进入商用工作流

研发方兔展智能专注视觉AI大模型研发,已推出Open-Sora Plan、UniWorld等系列视觉AI模型,相关技术正在加快产品化落地,近期将推出产模一体设计生产工具RabbitVis,推动视觉AI能力融入商业设计工作流。

优秘智能点评:此次开源的适配国产算力的世界模型方案,为各行业企业的3D内容生成、数字孪生、电商产品展示、虚拟场景搭建等场景降本增效提供了新的技术路径,企业无需从零搭建相关AI能力即可快速落地视觉类AI应用。如需定制企业级AI化经营、内容生产降本增效方案,可前往优秘智能官网umi6.com咨询了解。

读完这篇,下一步可以这样落地

把文章里的方法,拆成你的企业 AI 化方案

留下联系方式,顾问会结合你的行业、团队规模和当前业务目标,给你一份更具体的落地建议。

先做 AI 测评
结合行业场景输出落地路径信息严格保密
内容不是终点

让顾问帮你判断,哪些 AI 场景值得先做

一次沟通即可梳理当前业务里最容易产生回报的 AI 应用入口。

先做 AI 测评
结合行业场景输出落地路径信息严格保密