今天在WAIC昆仑万维论坛上,中国科学院院士周志华上了台。
他没讲大词,把世界模型的根拆开了——感知层、理解层、决策层。决策层最硬。因为你的每一步操作都在改变未来,推演100步之后误差会被放大到10000倍。Michael King早就从理论上写了结论:这件事几乎不可能做。
但周志华团队在细粒度分布匹配算法上找到了一个翻盘的办法——不考虑每一步对错,只考虑最后结果对不对。误差只会线性放大,不再是平方级。然后再把贝尔曼方程反过来推——数据量可以砍到原来的根号T分之一。
这场论坛背后站着的是一家默默铺了整张世界模型版图的AI公司——昆仑万维。在这一个上午里一把亮出了三条产品线:Matrix-3.5世界模型承接了视频交互和游戏场景,处于720P长程一致性前沿水平;
Mureka v9.5把AI音乐从"能听"推到了"有温度",是中国最强、全球前二的音乐生成大模型;黎曼1.0则是他们从视频生成一路跨进具身智能的第一张牌——在10万小时人工视频数据上训练,机器人在厨房整理、堆叠、叠衣服等多类长程任务上成功率全面领先开源VLA方案。
黄晓明和王珞丹也来了——不是为了公关照,是作为特邀嘉宾坐在前排现场交互认真讲了他们在创作和表演中使用AI的真实感受。
一场论坛能同时请来一位院士、两家国际技术伙伴和两组一线艺人为同一个话题站台——这大概已经是当下国内AI公司在行业号召力上的天花板。
公司创始人方汉说他最希望做到一件事:"人人如龙。"——把视频和音乐的门槛和成本拉到地板,让人人都能表达。
业界普遍期待他们有没有可能合作,会给产业带来怎样的进步?