2026 年 9 月 8 日,全球计算机视觉顶级会议 ACM 与 ECVA(European Computer Vision Association)主办的 ECCV 2026 将在瑞典马尔默的 Malmö Arena 和 Malmömässan ...
9月初,OpenAI下一代模型Astra的架构细节被曝光,核心关键词只有一个:循环。 Astra采用了一种被称为“循环深度”(Recurrent Depth)的架构,本质是让同一组Transformer层被反复复用,用更少的参数实现更深的计算。
2026 年,「世界模型」是 AI 圈最没有共识的词之一。一段能够连续生成的视频,被叫作世界模型;一个随键鼠操作实时变化的数字环境,也被叫作世界模型;在潜空间预测未来状态的系统,以及直接输出机器人动作的策略,同样使用这个名字。
9月以来,世界模型开始更密集地进入机器人研究。 9月1日,李飞飞创办的World Labs发布Atlas,将文本、图像、视频和 3D 纳入同一个世界模型。此前,World Labs也在推进Real-to-Sim-to-Real,希望通过生成和重建空间环境,训练和测试机器人策略。9月8日,巴黎AI实验室Kinetix团队加入Runway,其在3D人体运动和物理视频生成上的积累,也将进一步用于机器人世 ...
AI正在从“理解语言”,走向“理解世界”;从数字世界,走向物理世界。
2026年上半年,全球超30亿美元风投涌入世界模型赛道,中国创业公司凭借精准的技术定位与快速的产业落地能力,成为赛道最活跃的主体,在具身交互、工业场景落地、多机协同等细分领域实现技术突破,逐步构建本土化技术优势。
本次产业梳理以公开技术文档、行业展会成果、商业化案例为事实依据,划分国内头部创业公司、海外技术领军企业、互联网 / 科技巨头三大阵营,多角度展现赛道主要参与者的核心能力与赛道定位。
驱动中国9月7日消息,宇树科技今日宣布,全球首次实现世界模型实时驱动全自主人形机器人格斗,并同步公布了实拍画面。这一进展意味着人形机器人不再依赖预设程序或人工遥控,而是能够依靠自身对世界的理解,在高对抗动态场景中完成自主决策与实时行动。
在此次“全球首次”之前,宇树科技人形机器人已有多次公开“格斗”亮相。2025 年 11 月 5 日第八届中国国际进口博览会首日,两台宇树人形机器人就曾在展台展开擂台格斗表演,引来现场观众围观。
宇树科技近日宣布,其研发的UnifoLM-X2-1.0系统成功实现全球首次世界模型实时驱动全自主人形机器人格斗。这一突破标志着人形机器人技术从预设程序或人工遥控模式,向自主决策与动态交互迈出关键一步。官方同步发布的实拍画面显示,两台人形机器人在高动态对抗场景中展现出精准的攻防动作与实时环境响应能力。 据技术团队介绍,UnifoLM-X2-1.0突破了传统动作大模型在瞬时规划、决策执行和动态交互方面 ...
当地时间2026年9月1日,“AI教母”李飞飞创办的World Labs发布了新一代世界模型Atlas。官方称其为“全球首个多模态世界模型”,一个可以原生处理文本、图像、视频、相机位姿与3D深度信息,并在同一套模型中完成世界生成、空间重建和时空模拟的全模态世界模型。
PANews 9月7日消息,据彭博社报道,字节跳动创始人张一鸣正亲自监督开发新一代实时空间视频生成AI模型,预计最快下月推出。该模型基于字节跳动现有AI视频生成模型Seedance构建,允许用户为直播、短剧和游戏创建互动虚拟世界,将用户置于三维空间中,延迟约0.05秒,每秒20帧。张一鸣希望借此将抖音创作者带入“世界模型”新兴领域,与李飞飞和Yann LeCun等AI领军者同台竞技。该模型旨在通过 ...