ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

MoWorld-3D发布:以全栈自研突破,开启AI物理交互新时代

时间:2026-08-06 21:58:00来源:天脉网编辑:快讯

在2026世界人工智能大会(WAIC)期间,“世界模型”成为科技界与产业界共同关注的焦点。当多数视频生成技术仍聚焦于影视创作领域时,行业前沿已将目光投向更具突破性的方向——为视频模型赋予物理交互能力,让用户能够通过物理输入与虚拟世界实时互动。这一理念源于对现实世界的深刻理解:真正的世界不仅可被观察,更支持物理层面的交互操作,因此构建可交互的虚拟世界模型,本质上等同于创造一个数字孪生世界。

产业界对世界模型的需求正呈现爆发式增长。从工厂车间的机械臂操作到城市道路的自动驾驶,从家庭场景的服务机器人到工业测绘的精密建模,这些应用场景均要求AI系统掌握重力、碰撞、摩擦等物理规律。传统方法依赖真实环境中的反复试错,但高昂的成本与不可控的风险成为主要障碍。世界模型通过构建虚拟仿真环境,将训练过程转移至算力集群,显著降低了技术落地的门槛。目前,该技术已在游戏开发、影视制作、工业数字孪生等领域展现出巨大潜力。

7月16日,在WAIC开幕前夕,国家人工智能应用中试基地(具身智能)联合华为与魔芯(杭州)科技有限公司,在杭州正式发布MoWorld-3D世界模型。这款全栈基于昇腾NPU构建的交互式三维模型,标志着我国在空间智能领域取得重大突破。与实验室原型不同,MoWorld-3D将作为公共工具向全行业开放,支持各类空间智能应用的快速部署。

MoWorld-3D的核心功能在于其物理交互能力。用户可通过图像或文本输入生成具有空间结构的三维场景,这些场景严格遵循现实世界的物理逻辑。系统采用相机六自由度运动作为物理信号输入,允许用户在虚拟世界中自由行走、转身或环绕观察,生成的建筑结构、道路布局与物体位置均与真实空间高度吻合。这种设计使得虚拟场景不仅可用于可视化展示,更能支持物理层面的交互测试。

对于魔芯科技而言,此次发布具有里程碑意义。自2021年成立以来,该公司始终专注于4D动态世界基座大模型研发,以全国产算力为支撑,在自动驾驶、工业数字孪生、影视3D内容等领域布局深远。2025年12月,其与华为合作推出的KOKONI-World原型已验证技术可行性;2026年7月发布的MoWorld基座模型,则为MoWorld-3D的架构升级与工程化落地奠定了基础。从实验室原型到规模化应用,魔芯科技完成了关键跨越。

在技术参数方面,MoWorld-3D采用280亿参数的MoE混合专家架构,依托昇腾NPU集群实现稳定运行。其推理综合成本仅为同等规模进口GPU方案的30%,这一优势源于魔芯科技与昇腾AI长达一年的深度联合创新。双方团队针对长序列训练、多卡并行调度等难题展开系统性攻关,通过优化算子融合、混合精度量化等技术,将场景解码与主干生成任务拆分至多卡并行执行,大幅减少显存冗余与无效计算,最终实现高速低成本的虚拟世界生成。

该模型的落地对机器人与自动驾驶产业具有革命性意义。传统工业机器人与服务机器人的训练依赖真实环境中的反复操作,不仅设备损耗与时间成本高昂,还存在碰撞伤人等安全隐患。MoWorld-3D构建的数字仿真训练场,使机器人能够在虚拟空间中完成所有动作演练,碰撞与失误仅产生虚拟损耗,支持高频次复盘与迭代优化。这种训练方式显著降低了实体设备的损耗风险,同时缩短了技术落地周期。

在全球AI产业从语言智能向空间智能转型的关键时期,MoWorld-3D依托昇腾算力实现全栈自研突破,不仅为具身智能、自动驾驶等领域提供了自主可控的数字底座,更探索出一条空间智能产业自主化发展的可行路径。其低成本、高实时性的特点,为大规模商业化应用铺平了道路。

更多热门内容