2026-07-21 10:40:45 搜狐网
7月19日,在2026世界人工智能大会(WAIC)期间,昆仑万维举办“世界模型与多模态范式跃迁”专场论坛。会上,昆仑万维董事长兼CEO方汉正式宣布2026年为“世界模型元年”,并集中发布了Matrix-Game 3.5世界模型与Mureka v9.5&O3音乐模型的重磅升级。这标志着昆仑万维在多模态赛道上,正推动AI从单纯的“内容生成”向“理解物理世界”与“深度情感交互”迈进。

昆仑万维董事长兼CEO方汉
Matrix-Game 3.5:Patch级记忆注入,突破实时交互瓶颈
作为世界首个开源多模态世界模型,Matrix-Game 3.5在本次升级中实现了Patch级记忆注入与系统级性能优化。Skywork首席科学家成宇介绍,该模型在5B参数规模下,即可实现720p分辨率单卡20FPS的实时生成,并具备1分钟记忆能力。

Skywork首席科学家成宇
在技术架构上,Matrix-Game 3.5创新性地将历史帧切分为带有3D坐标的Patch Memory。推理时,系统根据当前相机视锥检索可见Patch并重新投影,作为Memory Token注入DiT模型,从而实现长期一致性的Patch级空间记忆。这一设计有效解决了传统Frame-level FOV Memory的痛点,带来了更准确的空间检索、更稳定的相机运动生成以及用户可自由编辑记忆块的可控能力。
此外,通过“减少模型吞吐+DiT模型优化+VAE剪枝”三重推理加速手段,Matrix-Game 3.5真正具备了实时交互能力。成宇指出,世界模型是具身智能的“无限数据引擎”。该模型构建了自动化数据生产管线,目前已积累超500万高质量视频切片、超1万有效训练小时数,覆盖1200余个游戏场景,为下一代世界模型提供了坚实的数据底座。
Mureka v9.5&O3:告别“AI味”,开启音乐版本化制作时代
在AIGC创作赛道,Mureka v9.5&O3的发布引发了广泛关注。v9.5版本首次打出“最没有AI味的AI音乐模型”标签,不再依赖声部堆砌制造复杂的听感,而是在真实的音乐框架中,以克制的方式处理编配、人声与情绪,让音乐表达更自然、真诚。
基于v9.5底座,O3模型通过test-time scaling扩展了MusicCoT的推理过程。它能够在生成过程中持续审视当前表达,回看偏差并进行自我修正,使音乐思维链逐步收敛。评测数据显示,Mureka O3在情感表达得分上达到7.88,在编曲结构上达到7.20,全面领先同类竞品。
更为重要的是,Mureka已从单一生成工具演进为“版本化制作”平台。用户可通过自然语言调用整曲生成、单轨生成、Remix等全链路能力;同时推出的Character功能,仅需一段声音或一张照片即可生成专属歌手角色,贯穿歌曲与MV创作。正如昆仑万维所倡导的,AI音乐正升级为一种自我表达的语言,大幅降低了创作门槛,释放了大众的深层创作力。
行业影响与高管观点:AI重塑文娱与物理世界
方汉在论坛上系统阐述了三大产业预判:第一,世界模型将走出屏幕进入物理世界,成为具身智能在陌生环境下“看得懂、做得对”的底层能力;第二,游戏行业将率先被世界模型改变,开放世界将随玩家行动实时生长;第三,AI音乐、视频等工具将促进AIGC的深层发展。
这一趋势在圆桌对话中得到了文娱界人士的印证。演员王珞丹坦言,创作者始终是表达的核心,AI能带来超出想象的流动性;中国电影家协会副主席黄晓明表示,AI生成的细节已难以分辨,他不仅认可其创作价值,更表达了投资AI相关项目的意愿;爱奇艺高级副总裁杨海涛透露,平台每日收到超3000部AI短剧,AI在特效制作上已实现超50%的提效。
从Matrix-Game 3.5的开源生态构建,到Mureka打通音画创作闭环,昆仑万维正以全模态技术重塑文娱与物理世界的交互范式。在“世界模型元年”的起点,昆仑万维不仅交出了全球领先的模型答卷,更为AGI时代的下一场多模态范式革命按下了加速键。