2026年9月12日,CCF YOCSEF技术论坛“世界模型如何刻画世界的多重维度?——物理环境与心智社会的建模、推演与验证”在中国科学院计算技术研究所举行。CCF YOCSEF总部学术委员会委员(AC)敖翔(中国科学院计算技术研究所)、李群(滴滴)担任执行主席。高校、科研院所、企业及YOCSEF各地分论坛代表参加。
论坛邀请极佳视界联合创始人、首席科学家、通用世界模型北京市重点实验室主任朱政,中国科学院计算技术研究所副所长、智能算法安全全国重点实验室主任程学旗,香港浸会大学计算机科学系助理教授白佳欣作引导发言;北京航空航天大学计算机学院教授黄迪、中国人民大学高瓴人工智能学院教授赵鑫、清华大学人工智能学院助理教授董胤蓬分别领衔三轮思辨。 开场,敖翔用一个Sally-Anne小球案例把大家拉进问题:萨莉离开后,安把球从篮子移入盒子,萨莉却可能仍相信球在篮子里。事实、信念、关系,三者一错位,行动就不再是简单的物理推演。这个案例随后反复出现,像一根针,扎破了“世界模型=物理仿真”的惯性想象。 朱政在《走向通用世界模型新时代》中,把世界模型从垂直场景走向通用能力的路径按分级思路铺开:家庭操作、工业作业、球类运动、交互式内容生成……这些探索让人看到世界模型的多种面孔。但他也提醒,能力往上走,仍要在高质量数据、模型架构、样本效率和商业化场景之间寻找可行路径。 程学旗的报告题为《世界模型不应只有物理维度——心智世界模型的内涵、挑战与实践》。他的判断很明确:AI一旦进入人类社会、参与协作,就不能只懂物理规律,还要处理人的信念、意图、情绪和社会规范。相同言行背后可能是不同动机;观测与交互本身,又会改变被观测对象。心智建模因此面临内涵边界、观测度量和验证评估等难题。 白佳欣带来《代码世界模型:把环境动力学写成可执行的程序》。他介绍,让大模型提出、筛选和修复程序,再由程序承担预测与规划。相关工作既从文本日志中归纳状态变化,也从视觉和仿真环境里识别动力学结构。不过,观测还原的保真度与任务效果并不等同,不确定性、复杂接触和跨环境迁移,仍是绕不开的关卡。
第一轮由敖翔主持。火花从“为谁建模”开始。
黄迪先把问题往回拽:世界模型被用于多种任务,面向不同任务构建的世界模型也不一样,但首先要说清楚,世界模型应该服务于怎样的智能体、应该达到何种能力水平,尤其是要结合现在以大模型为代表的前沿智能发展趋势。话音未落,CCF YOCSEF秘书长谭晓生的追问就来了——为什么要构建世界模型?当前究竟要解决什么问题?他建议把目标摁进具体场景,先划清边界。CCF YOCSEF总部学术秘书、北京邮电大学张宇超则提出另一条路:先构建共享基座,再加入个体信念、理解和社会关系,形成适配不同主体的模型。
可现场并没有顺着一条线走。领域模型如何协同、联合建模如何落地、状态该取该舍,各有各的坚持;分层还是并行,也没有谁能一锤定音。大家都承认要建模“世界”,但这个世界究竟是谁的世界,先谈清楚并不容易。
第二轮由李群主持。话题从“谁的世界”滑向“怎么推演”,难度没有降低,反而更具体。
赵鑫一上来就点出硬骨头:不同维度数据和训练信号差异大,统一建模困难;逐词元预测与隐空间状态预测各有取舍,数据规模、学习效率、训练稳定性,一个都不能轻看。CCF YOCSEF总部AC、微软亚洲研究院陈昊把难题往数据端推:具身数据难获得、成本高,未必覆盖建模因素。程学旗接过话头,回应可结合真实交互、场景构建和专业人员标注,同时把机制设计与评价摆上桌面。李群补充,自动驾驶里路测道路、人类司机驾驶行为和仿真数据,本就不能互相替代。朱政认为,仅靠二维视频监督可能不够,语言、多模态和交互数据值得探索;白佳欣则把代码世界模型往多智能体方向推。
路径越摆越多,问题却没有自动消失:状态更新依据什么?模型之间交换什么信息?推演一致性怎么保证?几条线头,仍悬在半空。
第三轮由敖翔主持。问题收束到“凭什么说它理解了”,也最难回答。
董胤蓬把“理解”拆成行为与机理两层:行为上,换表述、换人物、换环境,构造易错样本,看模型稳不稳、在哪里失效;机理上,还得追问它是否真正使用了与信念、关系有关的表征。他特别强调,能读出信息,不等于预测时用了它;干预表征、观察输出变化,能提供进一步证据,但能支撑多强“理解”,仍要长期研究。CCF YOCSEF总部AC、中国石油昆仑数智林秀峰把评价拉回最终任务效果。CCF YOCSEF总部AC、首都师范大学教授唐晓岚建议以儿童学习为参照,通过解决实际问题检验能力,并借鉴监护人的监督引导。真实环境反馈、反事实检验、综合评价被轮番提出,安全与社会规范也被纳入验证。
行为与机理、任务效果与理解证据,彼此之间并没有谁轻易说服谁,但边界被推得更清楚了。 论坛总结:凝练技术问题,推动成果积累 总结发言 CCF YOCSEF总部主席范举提出,应把讨论沉淀为可积累的技术观察与趋势判断,关注结果能否重复、能否形成系统能力、能否在真实场景中提质增效。谭晓生肯定了交流效果,也直言世界模型领域广、问题复杂,后续应与嘉宾核实并提炼观点。 论坛围绕建模对象、推演路径和验证依据,呈现了多种思路与待解问题,本次论坛没有给世界模型一个标准答案,也无意以“共识”消解分歧。几轮交锋之后,一些更本质的问题反而愈发清晰:世界模型若要真正走向真实世界,不仅要建模物理世界的“物”,更要理解心智世界的“人”;不仅要追求更强的生成与推演能力,更要经得起真实世界的检验——结果能否验证,能力能否复现,价值能否落地。把分歧摆出来,把问题辩清楚,把真正值得研究的问题留下来——这正是YOCSEF思辨的价值。



