7月19日,2026世界人工智能(885728)大会(WAIC)期间,昆仑万维(300418)“世界模型与多模态范式跃迁”专场论坛在上海举行。
昆仑万维(300418)董事长兼CEO方汉表示,2026年为世界模型元年,AI的核心命题将转向“理解”与“交互”。让AI真正理解物理世界的运行规律,并能与真实环境进行闭环互动。世界模型正是实现这一跨越的关键技术底座。
昆仑万维董事长兼CEO方汉
方汉还在演讲中阐述了对三大产业的预判。
世界模型将走出屏幕,进入物理世界。 具身智能正从实验室走向真实环境,这一趋势要求机器人在行动前先进行环境推演——预判动作后果、评估环境变化、及时调整应对策略。这种能力的突破,将使竞争焦点从单一任务转向陌生环境下的通用模型能力;谁能训练出在复杂场景中依然“看得懂、做得对”的模型,谁就拿到物理智能时代的入场券,这也是中国智能制造和机器人产业真正亟需的底层能力。
游戏(881275)行业将率先被世界模型改变。 未来三到五年,世界模型将成为游戏(881275)行业的基础设施,彻底刷新内容生产方式,而国产模型已在这一赛道领跑全球。
第三,AI音乐、AI视频等工具将从技术试验变成大众创作工具,促进AIGC的深层发展。这并非替代音乐人,而是大幅降低创作门槛,让更多人的表达得以释放,从而根本性改变音乐乃至整个 AIGC 产业的创作生态。
会上,昆仑万维(300418)宣布完成旗下核心模型迭代升级,推出Matrix-Game3.5世界模型、Mureka v9.5生成模型以及O3音乐模型。
据悉,世界模型Matrix-Game 3.5聚焦可交互世界模型技术,实现Patch级别的记忆注入与系统级性能优化,5B模型在720p分辨率下可实现单卡20FPS实时生成,具备1分钟记忆能力。Skywork首席科学家成宇在会上表示,Matrix-Game 3.5构建了支撑下一代世界模型的无限数据生产体系,打造三条自动化数据生产管线,输出Video+Pose+Action+Language的高质量训练数据,目前已积累超500万高质量视频切片、超1万有效训练小时数、覆盖1200余个游戏(881275)场景。
公司介绍称,Mureka v9.5&O3音乐大模型是在真实的音乐框架中,以更为克制的方式处理编配、人声、情绪与Prompt意图,让音乐表达更自然、更真诚。它不是简单“生成得更多”或“想得更久”,而是让模型在生成过程中持续审视当前表达:局部旋律是否仍服务全曲目标、编配是否遮蔽人声、情绪是否提前透支、结构是否正在偏离最初意图。
在“全模态内容革命——AI重塑视频、游戏(881275)、音乐与全球文娱”主题的圆桌对话环节,演员王珞丹分享了自己在AI创作中的感受,她认为创作者首先是一个判断者和决策者,需要用审美去筛选和决定最终呈现的画面,而AI能带来超出想象的运镜和流动性。她相信观众在意的是故事能否打动人心,而非媒介形态。
中国电影(600977)家协会副主席黄晓明提到,自己曾看了一部朋友制作的AI电影,三个月前看时还能明显看出AI表演的痕迹,但最近再看时,即便被告知那是AI生成,他已经完全分辨不出来了,“细节到脸上的斑点毛孔,甚至微表情、毛孔都在演戏。”他表示,未来希望投资AI相关的项目。
方汉表示,在AI影视中,技术上的难点并非大场面、爆炸等传统拍摄中昂贵的镜头,反而是小众场景因数据量不足导致效果不佳。“后AI时代,演员需学导演、导演需学表演,角色边界将日益模糊。”他表示。
