会懂网AI资讯获悉,2026年被业界称为”世界模型元年”。从谷歌、腾讯、蚂蚁到蔚来,头部企业密集发布世界模型产品,标志着AI正从理解语言文字的信息世界,迈向理解物理规律的现实世界。
世界模型的核心能力,是在数字空间复刻完整的物理规则。过去大模型的逻辑是预测下一段文字,而世界模型的目标是预测现实世界的下一时刻状态——理解重力、碰撞、空间、时序,能预判物体运动、行人动向和环境变化。这是机器人训练、工业仿真、自动驾驶的底层基础。
今年以来,世界模型密集落地。1月,谷歌DeepMind开放Genie 3公测,世界模型首次以可交互形态对普通用户开放;4月,腾讯开源混元3D世界模型2.0;6月,蔚来向超70万用户推送世界模型驱动的端到端驾驶系统;7月,蚂蚁灵波在几天内连发六款模型,昆仑万维在WAIC上宣布2026年为”世界模型元年”。
8月17日,智象未来正式发布HiDream-O1-World,一款原生全模态交互式世界模型,支持文本、图像、交互等多模态输入,用户可一键生成时空一致、符合物理规律、可长时推演的完整世界。智象未来CTO姚霆表示,交互式世界模型的价值,在于AI开始真正理解空间的深度、物体的质感、运动的惯性与光影的逻辑。
业内人士指出,算力成本、模型连贯性、产业资本三条此前各自爬坡的曲线,在2026年正同时跨过商用临界点。世界模型不再是仅供演示的概念,而是普通人高频接触的产品标配:玩游戏时动态生成的开放世界、家用机器人提前预演的家务动作、自动驾驶车辆预判的路况风险。
谷歌让普通人”创造世界”,蚂蚁让机器人”预演世界”,蔚来让汽车”预判世界”,这三件事接连发生,意味着AI真正看懂物理世界的风,已经来了。






























暂无评论内容