VISReg解耦尺度形状正则,解决SSL表征坍塌,性能优异。 JEPA世界模型的底层是Yann LeCun自2017年起持续倡导的自监督学习(Self-Supervised Learning, SSL)。 SSL 无需人工标注即可从海量数据中学习通用表征,但普遍面临一个核心难题——表征坍塌(representation collapse):模型倾向于把不同输入映射到相同或极少数几个向量上,看似完成 ...
千诀科技联合清华大学团队为此提出了一把新的神经网络“复杂度标尺”——有效阶(Effective ...
感觉国内 AI 基座模型里,又杀出来一个 Kimi 级的黑马。只不过这次不是 LLM,而是世界模型。 今天 HiDream-O1-World 正式发布。 这个模型的前缀可能大家都没怎么听说过,但看完它的生成效果,我估计接下来大家会频繁看到这个名字。
宇树机器人常被业内称为“小脑强于大脑”。宇树科技长期聚焦运动、关节控制等小脑能力,机器人能跑能跳,但在大脑层面,即具身大模型、任务理解与世界理解的能力上,研发投入一度有限。去年9月,宇树推出开源世界模型UnifoLM-WMA-0,想要为通用机器人学习 ...
千诀科技联合清华大学团队,为神经网络提出了一把新的 “复杂度标尺”。 随着模型训练数据量的增大,我们有越来越多的 benchmark 可以用于评价一个模型答得准不准,却很难判断它究竟学到了可迁移的规律,还是用复杂方式 “记住” 了训练数据。团队提出的 “有效阶”(Effective Degree,ED),首次将这项研究路线中抽象的 “简单性偏置”,转化为一个能在真实规模模型上计算、比较并直接参与训 ...
实验表明,即使将物理训练批次缩小至原来的四分之一、显存占用降低约 73%,Cross-Batch QQ 仍能使模型的平均规划成功率显著超过 LeWM。该结果表明, QQWorld ...
作者|冬梅Dario Amodei 一直是 AI 行业里一个颇为特殊的存在。如果说硅谷有一位 AI 掌门人,长期以来最不吝于提醒公众“AI 可能有多危险”,Dario 大概算其中之一。作为 Anthropic 联合创始人兼 CEO,他过去几年反复谈论 ...
世界动作模型的核心在于,先预测「下一步发生什么」,并为其设立目标,再让机器人看一眼目标,自己决定执行的每一步该做什么。 然而当前的主流方案有一个别扭的设计:训练时,模型学会「给定当前画面和动作,预测接下来发生什么」;部署时,控制器却从随机噪声中采样几千条候选动作序列,反复展开、评分、筛选,才能逼近一个接近目标的方案,耗费大量时间。 以 LeWM 为例,每次决策需要评估 9,000 条候选序列,单次 ...
中经记者 李玉洋 上海报道“跟几家VC聊,5—6月说完全不看‘世界模型’,7月就官宣投了‘世界模型’。”进入8月,美团原联合创始人‌、现投资人王慧文发文称:“AI的叙事真是按月变啊,跟不上节奏。”于是就有了开头这句感慨。在7月中旬举行的世界人工智能大会(WAIC ...
智平方在 2026 年 4 月发布了全球第一个类脑架构 VLA 具身大模型 NeuroVLA, 构建“皮层-小脑-脊髓”三层类脑体系。简单说, 就是把人类神经系统的分工机制搬进了机器人: 皮层管语义理解和任务规划, 小脑管高频运动协调和动态修正, 脊髓管毫秒级安全反射。
目前,有很多具身智能领域的创业公司,在机器人的智能提升方面努力,他们做的是怎么让机器人更聪明,更会干活。但机器人要进入更广泛的应用场景,并且做更“精细”的活,还需解决一个问题:交互界面。
Jeff Dean离职创业了,哈萨比斯也stepping down了。 而Gemini 3.5 Pro,还在「coming soon」。 一时之间,Google AI不是地震,也基本是海啸了。 在哈萨比斯卸任Google DeepMind CEO、转任DeepMind董事长及Alphabet首席科学家后—— Koray升任谷歌DeepMind高级副总裁,直接向劈柴哥本人汇报。 他将接管Google ...