7月19日,在2026世界人工智能大会(WAIC)期间,昆仑万维在上海西岸国际会展中心举办“世界模型与多模态范式跃迁”专场论坛。
中国经济网记者田云绯摄
昆仑万维董事长兼CEO方汉在论坛上提出,2026年将是“世界模型元年”,标志着AI从内容生成走向对物理世界的理解与交互的关键转折。此外,学界与产业界代表围绕世界模型的理论瓶颈、商业化路径等内容展开了讨论。
共话世界模型未来
中国科学院院士、南京大学教授、副校长周志华在主旨演讲中,围绕世界模型的前沿方向展开了深度分享。他将世界模型划分为感知层、理解层与决策层,并着重指出决策层世界模型长期面临“多步推演复合误差平方级放大”与“样本复杂度过高”两大理论瓶颈。
中国科学院院士、南京大学教授、副校长周志华。中国经济网记者田云绯摄
周志华分享了团队的最新突破:通过分布匹配技术可将推演误差从平方级压至线性级,验证了长序列推演的可行性。同时,通过创新性地逆向运用贝尔曼方程,将所需样本量降至原来的根号T分之一,为在战斗机操控、智能工厂等代价高昂的现实任务中构建决策世界模型提供了理论基础。他还提出“学件”概念——由模型与AI自动生成的“规约”共同构成,允许多个异构模型在不公开数据的前提下进行复用与组装,为世界模型从单产线定制走向可成长、可演化的模型生态开辟了新路径。
Reactor Technologies, Inc. CEO兼联合创始人Alberto Taiuti从产业落地角度指出,世界模型已从静态、高延迟、无状态的媒体生成范式,跃迁至有状态、实时交互、具备因果逻辑的新范式。他强调,世界模型不再只是生成视频或图像,而是能够持续推演环境变化并支持双向人机交互的“生成式软件”雏形。他以公司同名平台“Reactor”为例,展示了为世界模型原生设计的开发者基础设施如何在保持极低延迟与流式传输的同时,支持机器人、游戏、仿真等高频交互场景。
三大产业预判锚定未来方向
方汉在演讲中系统阐述了三大产业预判,他表示“这不只是昆仑万维一家公司的回答,更是中国AI从研发走向产业应用的一个缩影”。本次论坛上,昆仑万维还集中完成了三款核心模型的全球重磅升级。
昆仑万维董事长兼CEO方汉。中国经济网记者田云绯摄
第一,世界模型将走出屏幕,进入物理世界。具身智能正从实验室走向真实环境,这一趋势要求机器人在行动前先进行环境推演——预判动作后果、评估环境变化、及时调整应对策略。黎曼动力机器人推出Riemann-1.0,该模型基于超过23.2万小时多源具身交互数据训练,统一融合第一视角人类视频、UMI示教与异构机器人轨迹,并提出全因果世界动作建模架构与三阶段渐进式具身预训练框架。Riemann-1.0不再停留于仿真环境中的离线评估,而是在多个国际主流机器人Benchmark与真实机器人任务上同步实现仿真与真机双SOTA,为机器人操作、实时自适应控制及高频人机协作等PhysicalAI场景提供了从“理解世界”到“干预世界”的生成式行动基础设施。
第二,游戏行业将率先被世界模型改变。昆仑万维发布的Matrix-Game 3.5世界模型可实现虚拟世界随玩家行动实时生长、持续演化,未来三到五年世界模型将成为游戏行业基础设施,国产模型已在该赛道领跑。据Skywork首席科学家成宇介绍,Matrix-Game 3.5聚焦可交互世界模型技术,实现了Patch级别的记忆注入与系统级性能优化,5B模型在720p分辨率下可实现单卡20FPS实时生成,具备1分钟记忆能力。在技术架构上,Matrix-Game 3.5创新性地将历史帧切分为带有3D坐标的Patch Memory。
Skywork首席科学家成宇。中国经济网记者田云绯摄
第三,AI音乐、AI视频等工具将从技术试验变成大众创作工具,促进AIGC的深层发展。论坛上,昆仑万维发布Mureka v9.5&O3音乐模型。V9.5沿着MusiCoT路线完成了更扎实的底座升级:旋律、人声、音质和编曲全面提升,它不再把“更满、更复杂”当作唯一标准,而是在真实音乐框架中更克制地处理编配、人声、情绪和Prompt意图,让歌曲更自然、更真诚。O3则建立在V9.5之上,通过持续推演、回看偏差和修正后续决策,进一步强化旋律发展、编曲结构与指令理解,使歌曲结构更完整、情绪更连贯、段落关系更合理。更为重要的是,Mureka已从单一的音乐生成工具演进为完整的“版本化制作”平台。
从具身智能到文娱提效
在具身智能对谈环节,黎曼动力机器人创始人刘扬与破壳机器人创始人、清华大学交叉信息研究院助理教授许华哲围绕“具身世界模型的ChatGPT时刻”展开深度对话,探讨了世界模型与VLA的边界、机器人通用世界模型的训练瓶颈、具身智能的Scaling Law以及家庭机器人PMF等核心议题。
中国经济网记者田云绯摄
圆桌环节中,中国电影家协会副主席黄晓明称,从创作到投资,他对AI保持高度开放态度,明确表示很想去投资一些AI相关的项目——无论是科技方向还是影视方向。
演员王珞丹认为,创作者首先是一个判断者和决策者,需要用审美去筛选和决定最终呈现的画面,而AI能带来超出想象的运镜和流动性。她相信观众在意的是故事能否打动人心,而非媒介形态;创作者始终是表达的核心。
在青年导演崔睿看来,AI在影视制作中最能发挥价值的场景,恰恰是那些人力成本最高、执行最繁琐的“技术难题”——比如需要成千上万群演的大场面,这正是AI最擅长解决的领域。
爱奇艺高级副总裁杨海涛从平台数据出发,透露爱奇艺后台每日收到超3000部AI短剧与上千部AI漫画,AI内容观看数据持续提升。他以爱奇艺"燎原计划"扶持的网络电影《勿念》为例,AI在电影镜头特效制作方面实现超50%的提效,从导演构思到成片可节约三周以上的时间,他预计暑期将上线更多AI参与的网络故事片。
昆仑万维的布局从研发走向产业应用,方汉也在论坛上表示,AI厂商的核心目标是降低创作门槛与成本,“让AI从会生成走向懂世界、能行动”。