Physical AI 日报

今日要点

· 波士顿动力在现代佐治亚工厂开出 Atlas 训练中心,人形机器人开始在真实汽车产线上练零件排序

· Cognex 以 5 亿美元现金收购 RealSense,计入留任激励后总对价约 6 亿美元

· 特斯拉 Austin 近 7 天实际载客的 Robotaxi 回落到 8 辆,州注册的 Cybercab 却增至 67 辆

· Google 旗下 Intrinsic 以 Apache 2.0 许可开源 Intrinsic Core 的控制、运动规划与仿真模块

· GPT-6 Astra 直接当机器人策略,在 RoboDojo 42 项任务上平均成功率 22.48%,排在 40 个公开策略之上

论文进展

RoboDawn:不用机器人数据训练,让 VLM 直接闭环控制机械臂 · vla

这是今日社区热度最高的一篇(HF 96↑)。作者把机器人控制拆成一组离散的平移、旋转和夹爪指令,交给 agentic VLM 看图、推理、执行、再根据结果调整,全程不做针对任务的机器人训练。在 RoboTwin 2.0 C2R 上,零样本成功率 53.2%;加一条上下文示范后升到 73.6%,高于 π0.5 的 46.0%。Franka 真机上也跑通了放方块进篮子和叠方块两项任务。

Meng-Hao Guo et al. · arXiv 2609.22966 https://arxiv.org/abs/2609.22966

GPT-6 Astra 在 RoboDojo 上的首份系统评测 · vla

继上周 RoboHarm 与 YAM 双臂测试之后,这篇论文把"LLM 直接当策略"放到完整榜单上测。GPT-6 Astra 在 RoboDojo 全部 42 项任务上跑了 2100 次试验,平均成功率 22.48%,排在全部 40 个公开策略之上。用同样的后处理,GPT-5.5 只有 0.88%。它的能力分布很两极:语义理解类任务泛化得好,需要高精度、动态控制或复杂双臂协调的任务表现差,给一次示范也没有带来整体提升。

Wenbo Zhang et al. · arXiv 2609.24170 https://arxiv.org/abs/2609.24170

Grounded Action Model:以 3D grounding 为底座的机器人基础模型 · vla

现有 VLA 和世界动作模型的预训练骨干都不强制学"目标物体在哪、多大",这篇把度量几何放在模型最前面(HF 18↑)。语言、点或框提示先转成以物体为中心的表示,再和状态历史一起预测动作块。在 LIBERO-PRO 的 16 种扰动下平均成功率 61%,π0.5 为 53%。双臂 YAM 真机遇到视觉偏移时成功 17/20 次,π0.5 只有 4/20。

Gehao Zhang et al. · arXiv 2609.23863 https://arxiv.org/abs/2609.23863

CARE:从真实失败里学纠错的 VLA 执行框架 · manipulation

纠错数据通常靠人为设计扰动来造,CARE 改为收集策略真实跑失败的轨迹,按任务阶段统计失败后的偏移分布,据此合成失败状态和纠正示范(HF 10↑)。它在多个 VLA 骨干上都有效:仿真平均成功率提升 14.5 个点,双臂真机提升 15.9 个点。代码、模型和数据已公开,另附一个失败恢复评测集 FSR-Bench。

Junlan Xiao et al. · arXiv 2609.24118 https://arxiv.org/abs/2609.24118

EgoWild2Dex:用家庭、工厂、药房里的第一视角视频教灵巧手 · manipulation

人类视频数据多在特意搭建的场景里采集,这篇改为让人戴头戴相机做日常工作,攒出 538.9 小时的 EgoWild 数据集:179,049 段,覆盖 1,282 类物体。配套方法对齐晃动的人眼视角和机器人观测。三项长程双臂灵巧任务真机平均成功率 96.7%,物体级零样本成功率 33.3%。作者称数据、模型和代码将会公开。

Kunyang Lin et al. · arXiv 2609.23755 https://arxiv.org/abs/2609.23755

RAPolicy:1-2 小时真机在线后训练 VLA · vla

采样和学习异步并行,critic 和 actor 的更新都锚定在回放数据上,减少对覆盖范围外动作价值的依赖。每个任务只有 10 条示范起步,在线训练 1-2 小时。四个单任务平均成功率 86.3%,五任务联合设置从 52% 提到 88%,需要的人工干预也更少。

Jiarui Yang et al. · arXiv 2609.22888 https://arxiv.org/abs/2609.22888

动作写成绝对值还是增量,世界模型就会给出两种答案 · world-model

同一条指令轨迹,写成绝对关节目标或相对增量,在另一种写法上训练的 latent 动力学模型就会失效:在三个机器人数据集上检索性能下降 2.6 到 13.4 倍,目标条件动作选择从 53% 掉到 15%。两种编码之间可以互相重建(R² 0.996),信息并没有丢,问题出在动作通道从没被审查过。作者给出的修复是在两种编码上平均训练目标,再加一项分歧惩罚补最坏情况。

Ahmed Karim et al. · arXiv 2609.23252 https://arxiv.org/abs/2609.23252

Uranus:用自回归扩散模型替代手工搭建的机器人仿真器 · world-model

输入未来的关节位置轨迹,模型就逐步生成多视角画面,没有固定时长上限,推理优化后达到 24 FPS,并支持多种机器人本体和相机配置。代码和权重已放出,论文也单列了当前的局限。

Wenkang Qin et al. · arXiv 2609.24815 https://arxiv.org/abs/2609.24815

其他今日论文:CHOREO(把人形机器人的各类技能统一成可执行轨迹,免训练拼接,130 个多动作任务序列成功率 95.4%,arXiv 2609.22274 https://arxiv.org/abs/2609.22274);GLIDE(让模型自己写防护规则,辅助采集人类难以示范的任务数据,采集成功率从 0-10% 提到 70-90%,arXiv 2609.24996 https://arxiv.org/abs/2609.24996);What Matters in Designing World Action Models(系统对比 6 种因果结构、8 种隐空间、4 种训练目标,arXiv 2609.24048 https://arxiv.org/abs/2609.24048);SmoLSTM(用循环状态给小型 VLA 加持久记忆,arXiv 2609.22854 https://arxiv.org/abs/2609.22854);VT-Bridge(轻量残差适配,把现成 VLA 扩展成视触觉 VTLA,arXiv 2609.22606 https://arxiv.org/abs/2609.22606);LIBERO-VPro(机器人基础模型闭环视觉鲁棒性评测,arXiv 2609.24350 https://arxiv.org/abs/2609.24350);FoldQuantVLA(VLA 原生低比特量化,arXiv 2609.24433 https://arxiv.org/abs/2609.24433);Think Like a World Model, Act Like a VLA(把世界模型表示蒸馏进小策略,HF 3↑,arXiv 2609.24682 https://arxiv.org/abs/2609.24682)

开源·工具·评测

· Intrinsic Core:Google 旗下 Intrinsic 以 Apache 2.0 许可开源工业机器人平台的底层 Intrinsic Core,包括控制、运动规划和仿真软件,兼容 ROS,已在真实部署中使用。Intrinsic 从 Alphabet 登月工厂拆分出来五年后并入 Google,现与 Google DeepMind、Google Cloud 合作,平台接入 Gemini 模型。Forbes 称之为 Google 在免费送出"机器人的 Android"。 https://www.therobotreport.com/intrinsic-open-sources-key-parts-platform-easier-development/

· NVIDIA Isaac ROS 5.0:把机器人专用知识打包成人类工程师和 AI 编程代理都能调用的 skills,新增 FoundationStereo 微调、更快的 FoundationPose 物体跟踪和独立抓放;支持 ROS Lyrical 与 Ubuntu 24.04,算力覆盖 Jetson Orin Nano 到 Jetson Thor,免费开源。 https://www.techbuzz.ai/articles/nvidia-isaac-ros-5-0-brings-agentic-ai-to-open-robotics

· Light-O1-Preview:亮源新创(Light Origins)以 Apache 2.0 许可放出约 60 亿参数的全身动作模型。输入文本指令,输出 20 帧/秒的全身动作序列,每帧 138 维,含 22 个关节。模型先用从互联网视频恢复的人类动作预训练,已在自家 LightBot 和宇树 G1 上演示。 https://pandaily.com/light-origins-light-o1-preview-6b-apache-human-video

融资与交易

Cognex × RealSense | 收购 | 5 亿美元现金 | 总对价约 6 亿美元 · hardware

机器视觉厂商 Cognex 用自有现金收购深度相机公司 RealSense,基础价格 5 亿美元,预计第四季度交割。以色列 Globes 报道的"超 6 亿美元"包含两部分额外支出:三年期现金留任计划 5650 万美元,以及约 5000 万美元的限制性股票。RealSense 两年前从 Intel 拆分时季度营收只有 700 万至 800 万美元;Cognex 预计它 2026 年营收 8000 万至 9000 万美元,同比增长超 50%。Intel 仍持股 20%,将随交易一同退出。来源:Globes https://en.globes.co.il/en/article-cognex-buys-israel-based-realsense-for-over-600m-1001556995、Cognex 投资者公告

陈龙新公司(前小米 XLA 负责人)| 已获融资 | 金额未披露 · world-model ⚠️ 单方口径

陈龙此前负责小米汽车智驾基座模型和 XLA 大模型,现赴硅谷创业,任联合创始人,搭档一位前 Google DeepMind 科学家做具身大模型。21财经称项目已拿到融资并有商业化合作。一位投资人说,陈龙想做的是"自进化"的具身大脑,而不是靠堆数据或改训练方式去追规模法则。雷军对其创业表示支持。小米智驾团队已引入多位地平线高管,接替陈龙和前 L3 负责人王乃岩的工作。来源:21财经 https://tech.sina.cn/2026-09-22/detail-inissyqx6879695.d.html?vt=4&wm=2284_1116?pt

先途起源 | 种子轮 | 数千万元 · embodied

啟赋资本领投。公司今年 6 月注册,核心团队来自国防科技大学机器人实验室(中国第一台仿人机器人"先行者"出自这里),定位是在工业现场做精细操作的具身任务执行。来源:DoNews https://www.donews.com/news/detail/8/6719441.html

欢创科技(Camsense)| 港股 IPO 招股 | 约 7800 万美元 · hardware ⚠️ 单方口径

继 9 月 13 日通过聆讯后,这家扫地机器人传感器零部件商开始招股。来源:The Bamboo Works https://thebambooworks.com/robot-vacuum-component-maker-camsense-launches-78-million-hong-kong-ipo/

商业化落地与部署

Atlas 进驻现代佐治亚工厂,开始在真实产线上练零件排序 · humanoid

波士顿动力在现代汽车集团美国工厂 HMGMA 内开设 Robotics Metaplant Application Center(RMAC)。这座工厂位于萨凡纳附近,生产 Ioniq 5、Ioniq 9 等电动和混动车型。Atlas 在这里做的是总装前的零件物流和排序:把零件按装配顺序摆好。明年训练中心搬进新楼,面积扩大约 10 倍,并开始探索汽车以外的行业。现代的目标是在未来几年向现代和起亚全球工厂投放 2.5 万台 Atlas。眼下这仍是训练和测试阶段,离节拍稳定的量产作业还有距离。来源:The Korea Times https://www.koreatimes.co.kr/amp/business/companies/20260922/hyundai-motor-group-opens-robot-training-center-in-us

特斯拉 Austin 实际载客车队回落到 8 辆 · autonomy ⚠️ 汇编口径

Electrek 引社区追踪站 Robotaxi Tracker 的数据:过去 7 天在 Austin 被观察到载客的特斯拉 Robotaxi 只有 8 辆,和 2025 年 6 月刚开服时差不多。9 月 3 日 Cybercab 发布活动前后,这个数字一度冲过 100 辆,全年大部分时间在 20 到 40 辆之间。同一时期,特斯拉又向得州车管部门登记了 28 辆自动驾驶车,州内注册总数到 476 辆,其中 Cybercab 67 辆,Model Y 409 辆。注册数不代表载客数,两组数据之间的差距正在拉大。来源:Electrek https://electrek.co/2026/09/22/tesla-robotaxi-active-fleet-austin-crashes-8-vehicles/、eletric-vehicles.com https://eletric-vehicles.com/tesla/tesla-adds-28-robotaxis-in-texas-lifting-cybercab-fleet-to-67/

LS Electric 两台 Spot 转为常规巡检 · industrial

这两台 Boston Dynamics 的 Spot 部署在 LS Electric 釜山工厂,也就是它的特高压变压器主产地。今年 7 月起与现代 AutoEver 试运行约两个月后正式投入。Spot 用热成像非接触检查气相干燥室门封是否漏热,同时采集泵、电机和控制柜的热、噪声与振动数据,用来预警故障。LS Electric 计划据此训练 AI 分析模型,再推广到国内外其他工厂。来源:The Korea Times https://www.koreatimes.co.kr/amp/business/companies/20260922/ls-electric-deploys-robotic-dogs-to-drive-smart-factory-automation-in-busan

广东已有超 2000 台人形机器人进厂 · humanoid

广东第二届人工智能应用大会"AI+制造"专场签下 8 个具身机器人规模化应用项目,总投资 7500 万元,场景包括产线、图书馆、地铁、社区和体育场馆。会上披露,广东制造企业目前已部署人形机器人超 2000 台,预计全年突破 3000 台。来源:21财经 https://www.21jingji.com/article/20260922/herald/2aedfa4d54657a83c7ef31bdd412ebae.html

Aurora 定下 2028 年自由现金流转正目标 · autonomy ⚠️ 计划口径

Aurora 目前有 20 辆无人驾驶重卡在公共道路运营,跑休斯敦至达拉斯、沃斯堡至埃尔帕索两条线,目标是年底增至 200 辆。创始人兼 CEO 对 CNBC 说,靠车队扩张,公司 2028 年实现自由现金流为正。作为对照,Aurora 2025 年亏损超过 8 亿美元。来源:CNBC https://www.cnbc.com/2026/09/22/aurora-autonomous-semi-ride.html

小鹏第二代 VLA 新版本开始推送 · autonomy ⚠️ 厂商口径

XOS 6.3.0 于 9 月 22 日开始推送。蒸馏版 VLA Lite 首发 G9L Max,并覆盖 MONA L03、GX、G7、P7 以及 2026 款 M03、G6、G9、P7+、X9。来源:汽车之家 https://chejiahao.autohome.com.cn/info/26511755

产业动态

小鹏机器人完成审厂和核心零部件定点,供应商与特斯拉高度重合 · humanoid

9 月 22 日,小鹏集团召开首届机器人供应链合作伙伴大会,执行器、灵巧手、传感器、AI 芯片等领域的供应商到场。据澎湃报道,小鹏机器人已完成供应链审厂和核心零部件定点,技术路线、产品形态和量产节奏都已明确。上周特斯拉工程师刚来中国审计 Optimus 供应商;消息人士称,两家在核心供应商层面"存在较高的重合度"。来源:澎湃新闻 https://www.thepaper.cn/newsDetail_forward_34123642

奔驰签约 Wayve,约两年内把 AI Driver 装进量产车 · autonomy

梅赛德斯-奔驰与英国 Wayve 签下多年期协议,基于奔驰 MB.OS 架构,在约两年内把 Wayve 的端到端自动驾驶系统集成进未来车型。奔驰此前参与了 Wayve 的 D 轮融资。来源:Global Banking & Finance Review https://www.globalbankingandfinance.com/mercedes-wayve-partner-up-autonomous-driving/

Figure Helix 2.5:30 户陌生家庭零样本做家务,成功率 56% · embodied ⚠️ 厂商口径

Figure 03 在湾区 30 户从没去过的家庭里做三项家务,包括把散落的玩具收进篮子,不做任何现场微调,成功率 56%。任务数据、架构和评测都不变,只在人类行为数据 Index 上预训练,零样本成功率就从 9% 升到 56%。Figure 宣称每次把预训练数据翻倍,损失下降平滑到能提前预测,并据此说找到了机器人的 scaling law。换个角度看,近一半尝试仍然失败。来源:机器人大讲堂 https://www.leaderobot.com/news/9782

2025 年全球人形机器人销量:IDC 称 1.8 万台,IFR 称约 7000 台 · adjacent

TechJuice 引 IDC 数据称,2025 年全球人形机器人出货 1.8 万台,同比增长 508%,中国厂商占九成。昨天 IFR 给出的数字是约 7000 台,统计范围限于工业和专业服务用途。两家机构的计数口径不同,数字相差一倍多。来源:TechJuice https://www.techjuice.pk/humanoid-robot-sales-2025-china-market-expansion/

爱普生三年投 2800 亿日元押注机器人和精密业务 · industrial ⚠️ 计划口径

社长吉田潤吉在首尔宣布,精工爱普生未来三年投资 2800 亿日元(约 2.4 万亿韩元),相当于去年 1.4 万亿日元营收的 20%,重点投向工业机器人和精密元件。目标是到 2035 年把新业务营收占比从去年的 33% 提到 50%。同日,爱普生推出首款协作机器人。来源:Seoul Economic Daily https://en.sedaily.com/finance/2026/09/22/seiko-epson-to-invest-24-trillion-won-in-robotics-over

具身数据集质量行标 11 月 1 日施行 · adjacent

行业标准 YD/T 6771-2026 由中国信通院牵头、40 多家单位起草,从完整性、一致性、多样性、真实性和安全性几个维度评估具身数据集质量。截至 6 月底,全国已投用的具身智能训练场超过 70 个,另有 40 多个在建或规划中。来源:Pandaily https://pandaily.com/china-embodied-ai-training-grounds-70-plus-dataset-standard-nov-1

长三角前 8 个月出口四类重点机器人 160 亿元 · industrial

手术机器人等四类重点机器人出口额同比增长 3 倍来源:观点网 https://www.guandian.cn/article/20260922/605862.html

硬件·供应链

· 宇树 Dex5-S 灵巧手:22 个自由度,比上代在小指上多一个侧摆;尺寸和真手 1:1(102×187×26 毫米),重约 620 克;单手最大负载 2 千克、持续负载 1 千克;3.99 万元起,Pro 版增加触觉感知。 https://news.mydrivers.com/1/1152/1152949.htm

· Maxon EC i 70:800W 无刷电机,面向对成本敏感的大功率应用。 https://www.roboticstomorrow.com/news/2026/09/21/maxon-introduces-ec-i-70-800w-brushless-motor-for-cost-sensitive-high-power-applications/27133

· Aeonsemi Praxium:面向 physical AI 的多千兆以太网 PHY 芯片。 https://www.prnewswire.com/news-releases/aeonsemi-unveils-praxium-multi-gigabit-ethernet-phys-for-physical-ai-302885523.html

· 芯驰科技 × APAQI Robotics:合作开发具身机器人的计算与控制平台。 https://autonews.gasgoo.com/articles/icv/semidrive-apaqi-robotics-collaborate-on-computing-control-platforms-for-embodied-robots-2102226112297238528