研究解读 RESEARCH

9 篇 · 按编号倒序
公开研究解读№ 065RESEARCH

Arm 发布 Robotics Capability Framework:机器人能力的"普通话"试图统一

Arm 首席架构师 Richard Grisenthwaite 推出与架构无关的能力描述框架,把机器人能做什么、需要什么运行环境、需要多少监督、给什么安全保证写进同一套词汇表。它不是新标准,但可能是第一个能跨厂商串起来用的。

研究解读Arm机器人能力框架
来源 · Arm 2026-09-08 官方公告 + GamesBeat 同期报道 + STRADVISION / ZaiNar 接入披露 + GB/T 47245-2026 国家标准对照·09-09·8 分钟公开
公开研究解读№ 058RESEARCH

RoboGesture 拆解:让机器人边说边比划,难点不是「会动」是「别乱动」

机器人会说话之后,最尴尬的是手不知道往哪放。银河通用联合六校的 RoboGesture 把自碰撞帧率从 4.16% 压到 0.13%——这项研究真正的工程难点,不是让动作像人,是让动作不伤到自己。

研究解读RoboGesture银河通用
来源 · 机甲觉醒(2026-09-07)+ 机器人前瞻转网易(2026-09-07)+ Interesting Engineering / Humanoids Daily / robogesture.github.io 项目页交叉·09-08·10 分钟公开
公开研究解读№ 052RESEARCH

训练完就退场的世界模型:光象 Phi-WM 把 80.3% 留在了部署之外

光象科技与清华李升波课题组的 Phi-WM 1.0 ActEffect,让世界模型只在训练时上班、部署时退场。真正有意思的不是 80.3% 这个分数,是它的消融实验:去掉后果反馈,分布内只掉 1.8 个点,分布外掉 28.8 个点。

研究解读世界模型VLA
来源 · 量子位 2026-09-05 报道 + FutureX Physical AI Daily Issue 111(2026-09-06)交叉·09-07·8 分钟公开
公开研究解读№ 046RESEARCH

星尘智能 SmoothRL:投掷 39% 到 94%,三个成功率数字该怎么读

动态投掷 39% 提到 94%,给笔戴帽 8% 提到 83%,开箱 30% 提到 90%。三个数字都很硬,但它们不是这篇报告里最值得看的部分。最值得看的是那条 30%→20%→40%→90% 的非单调曲线,和「机器人错法变了」这件事。

研究解读强化学习异步推理
来源 · 星尘智能 SmoothRL 技术报告 + 腾讯新闻·星河频率、云启创投、搜狐科技交叉核验·09-04·12 分钟公开
公开研究解读№ 043RESEARCH

「零真机数据」站得住吗:深朴 HiFi-UMI 的 2 万小时与 3 毫米

深朴智能说它的 Omni-Simple-World 模型「预训练与后训练全程未使用任何一条真机数据」。这句话在技术上是成立的,但在传播上极其容易被读歪——它绕开的是机器人本体,不是真实世界。

研究解读数据采集UMI
来源 · 机器人前瞻(2026-09-03)+ 深圳市《智能机器人产业工作方案》UMI 表述交叉参照·09-04·10 分钟公开
公开研究解读№ 026RESEARCH

智谱 GLM-5.3-Flash:同档智力只要 1/40 价格,但三个坑别被「白菜价」带偏

智谱 GLM-5.3-Flash(中文圈称「牛来」)以约 1/40 的单价追平 Claude Opus 4.8 的智力指数,MIT 开源、原生多模态、跑在国产芯片上。对机器人仿真与专家 IP 内容降本很香,但限时价、速度和本地部署门槛三件事被原帖讲轻了。

研究解读GLM-5.3-Flash智谱
来源 · 智谱官方发布页 + Artificial Analysis + OpenRouter 流量披露,经 @linyiLYi 长文交叉核实·08-28·13 分钟公开
公开研究解读№ 010RESEARCH

VLA 与世界模型之争结束了吗:2026 智源大会上的那个共识判断

行业吵了几个月的「VLA 还是世界模型」,在 2026 智源大会上被给出一个共识判断:世界模型不是 VLA 的竞争路线,而是 VLA 体系的核心组成部分。本文拆这个判断是怎么成立的,以及它对做落地的人意味着什么。

VLA世界模型具身大脑
来源 · 2026 智源大会 / 界面新闻 / 南方+·08-27·14 分钟公开
公开研究解读№ 002RESEARCH

π0.7 与组合泛化:机器人领域的「GPT-3 时刻」到底指什么

Physical Intelligence 的 π0.7 被称为机器人领域的「GPT-3 时刻」,关键词是组合泛化——模型见过「抓红杯」和「杯子烫就用夹子」之后,能组合出没练过的动作。它还首次把世界模型作为 Subgoal Image Provider 集成进 VLA。

Physical Intelligenceπ0.7组合泛化
来源 · 公开研报与行业报道·08-19·12 分钟公开