━━━━━ 正文从此处全选复制 ━━━━━
FutureX · Physical AI
本周要点
· 上半年全球人形出货,IDC 记近 2.5 万台,沙利文记 3.6 万台,约 1.1 万台差额无人解释。
· 优必选 U1 报 13361 台订单,CFO 给的年内可交付量只有 1500 至 2000 台。
· AMD 以 82 亿美元收购 World Labs,同周论文测得世界模型只能规划 5 到 10 步。
· 7 个 VLA 仿真基准查出 22 个 bug,修掉后方法排名倒转。
· 波士顿动力、Sharpa、宇树同周削减自由度,用灵巧度换成本和可靠性。
· 易控无人矿卡过 1500 台,公路上的 Robotaxi 车队仍是百台量级。
▎ 人形机器人的销量数字,本周在统计口径和交付兑现两头都对不上
IDC 在 9 月 29 日发布报告,认为 2026 年上半年全球人形机器人的出货量接近 2.5 万台。弗若斯特沙利文前一天给出的上半年销量则是 3.6 万台。两家机构都没有解释,约 1.1 万台的差额是怎么产生的。沙利文的拆分显示,小尺寸产品销量为 1.97 万台,收入仅 0.19 亿美元,而生产作业场景只卖出 0.12 万台。智元在 9 月 30 日自行报告,上半年出货超过 8600 台,并称这占全球的 35%。以 IDC 的总量作分母,这一比例大致说得通;改用沙利文的总量,则只剩 约 24%。
9 月 27 日的一期曾对比 2025 年的两种口径:IFR 记录约 7000 台,IDC 记录 1.8 万台。预测数字之间同样存在分歧。摩根士丹利对 2026 年中国人形机器人出货量的预测,原为 1 月的 1.4 万台,之后两次上调,现为 5 万台。摩根大通对中国给出的数字同样约为 5 万台,不过其中包括足式机器人。此外,摩根大通预计,到 2035 年全球混合均价累计下降约 56%,因此出货增速不会等比例转化为收入。
在交付方面,优必选 CEO 周剑 6 月 30 日披露,U1 的全渠道订单为 13361 台。到了 8 月 30 日的财报电话会,CFO 张钜表示,今年实际可交付 1500 到 2000 台。公司 9 月 28 日说,正按预订先后分批排产;但天猫和京东旗舰店的客服却告诉消费者,首批要顺延到 11 月 30 日之后。预售阶段只收取 3000 元、可以退还的定金。启元的 Q1 和 T1 于 10 月 1 日在三座城市交付了首批,交付台数没有公布。云深处的招股书里,几组人形机器人数字也彼此对不上:9 月 28 日的报道称 2025 年 DR 系列售出 1 台,次日的拆分写的是 2026 年上半年售出 6 台,10 月 3 日的另一篇报道又说两年累计出货 4 台。
本周还出现了现场作业中人力配比的数字。珠海长隆乐园有 300 多台智元人形机器人,目前平均每 3 台安排 1 名操作员,智元的目标是 1 人照看 10 台。Nucleus 公开了近两小时未经剪辑的工厂视频,称作业中 60% 为自主完成,40% 靠遥操作,但没有说明比例的算法。在爱仕达的门店里,灵犀 X2 被顾客追问具体优惠时,把顾客转给身边的真人导购完成成交。
在上市方面,CNBC 援引三位知情人士的话报道,证监会通过窗口指导,为具身智能企业的 IPO 设了三条门槛:收入和订单要可持续;亏损要收窄,并提供三年预测;要掌握大脑或灵巧手一类的核心技术。摩根大通首次覆盖宇树,就给出"减持"评级,目标价 300 元。按报告测算,9 月 30 日的收盘价 450.40 元,对应 2027 年约 46 倍市销率;报告的原话是"减持的是价格,不是公司"。野村的评级为"买入",目标价 370 元。云深处的更新稿首次披露,其第一大客户 A1 正通过自研和并购来做同类产品。
▎ 资金继续押注机器人大脑和世界模型,论文同周量出了世界模型的规划半径
AMD 将以全股份方式、作价 82 亿美元收购 World Labs,李飞飞随之出任 AMD 执行副总裁兼首席科学家。她在公告文章中写道,要扩大规模,就需要"离硬件更近"。General Intuition 按 62 亿美元估值融资 2.2 亿美元;其 MIRA 目前只能生成一款游戏的画面,商用版仍在少数机器人和仿真客户那里测试。Business Insider 援引一位知情人士的话称,FieldAI 已就 7 亿美元的新一轮融资签下条款清单,估值达 100 亿美元,而去年的估值是 20 亿美元。
国内一级市场同样热闹。苏度科技的新一轮融资超过 10 亿元。诺因智能成立仅一年,已融资 5 轮,累计超过 10 亿元,本轮与上一笔相隔只有 49 天。这几家公司公布的能力数字都出自自我报告:Skild AI 称,S1 在新的多步任务上每步成功率约为 66%,同类系统为 9%;苏度称,零样本条件下关键任务的成功率接近 100%;诺因称,GLOW 比 GPT-6 基线高出 40 个百分点。这些数字目前都没有第三方复现。同一周,深圳盈合机器人进入破产程序,该公司累计融资超过 6 亿元,2025 年营收为 433 万元。
在论文方面,有一项研究在 V-JEPA 2、DINOv2 等五个冻结骨干网络上训练动作条件预测器,发现模型只能对 5 到 10 步以内的目标做出可靠的动作排序,而任务目标通常在 16 到 53 步之外。把预测器放大 81 倍,可规划的范围也没有变长。改用能完美预测的真实模拟器后,目标从 5 步外移到 20 步外,成功率仍从 92% 跌到 41%。另一篇论文发现,4 个潜空间世界模型对末端位置的编码误差,都超过了成功判据所允许的容差。北大与 NVIDIA 的 PhysisForcing 在训练时加入物理监督,使闭环操作的成功率从 16% 升到 24%。
在数据规模方面,IronMind 把人类第一视角视频的预训练量加到 1 万小时,六项真机新任务的成功率为 55.0%,而 5000 小时及以下的各档,最高只有 11.7%。成绩的跃升集中出现在 5000 到 1 万小时之间。InternW0-Δ 整理了逾 2 万小时的异构语料,并表示将开放代码、权重和数据。Runway 的 Praxis-1 则给出相反的数字:用网络视频预训练的策略,放置误差为 16.1 cm;用遥操作视频预训练的为 16.0 cm,差异并不显著。
▎ 仿真基准本周暴露出 bug 和饱和,榜单名次难以直接当作能力证据
有些免训练的 VLA 加速方法只是对原模型的近似,测得的成功率却比原模型更高。一个团队从这一反常现象入手排查,在 RoboTwin、LIBERO-Plus、VLABench 等 7 个基准中发现了 22 个 bug,另有 4 处设计缺陷。修复 bug 之后,某项任务上的原模型从最后一名升到了第一名。在另一项任务上,修正设计缺陷前,原模型落后加速方法 21 个百分点;修正后,它反而领先 5 个点。
LIBERO-MAX 使用 8000 对配对用例,在任务进行到一半时移动目标并切换视角。接受测试的 14 个策略成功率全部下降,降幅在 11.0 到 25.7 个百分点之间。在 Meta-World 榜单上,中科院团队的 Maxwell 以 91.9 分居首,前三名之间的差距不到 4 分,说明该基准已接近饱和。FLUX 3 Action 在英伟达自家的榜单上以 42.9% 排名第一,不过这一成绩目前只有单方面的报道。
评测器本身出错时,自动改进系统会顺着错误的方向继续优化。在新加坡国立大学的一份负面结果报告中,智能体自主改进了 123 轮,每次改动都通过了测试,目标任务却一次也没有成功;评测器测错的地方,智能体照样会去优化。一项 Real-to-Sim 的实测则说明了仿真分数在什么条件下可信:经过精细重建后,仿真得分与真机得分的相关系数为 0.90,而默认的开源流程只有 0.51。TRUST 将英伟达驾驶 VLA Alpamayo 1.5 的推理正确率从 75.9% 提高到 90.0%;换到操作 VLA 上,推理正确率同样有所提升,但 LIBERO-Plus 的闭环成绩基本没有变化。
▎ 灵巧手和关节本周在几家厂商那里同时做减法
波士顿动力为 Atlas 换上了新手:三根手指各有 3 个自由度,对生拇指有 4 个,合计 13 自由度,上一代是 7 个。新手去掉了小指,由此省下 3 个执行器。所有执行器都已封装,并且只采用一种型号,也没有线缆穿过关节;公司称,这样有利于量产和维修。CTO Zack Jackowski 曾让团队成员把小指和无名指缠在一起生活一天,记录哪些事情做不了,最后的结论是四根手指就够用。
Sharpa 的 W02 把主动自由度从上一代的 22 个减到 21 个,去掉了使用率较低的小指根部旋转关节,体积也缩小了 30%;与之配套的 AE01 采集手套,输入端仍保留 22 个自由度。宇树的 R1 AIR 比 R1 便宜 1 万元,关节数从 26 个减到 20 个,保修期也从 8 个月缩短为 6 个月。大寰在 IROS 上首发的五指手同样有 13 个主动自由度,传感器和各模块都可以单独更换。据 The Information 报道,Optimus 的手部传感器存在可靠性问题,特斯拉计划明年改用可更换的传感"手套"。
在上游,订单与交付之间仍有距离。福莱新材手上的触觉订单已达数十万套的量级,但 2025 年 12 月实际交付的只有千套。关节模组方面,万里扬的首条产线通过了客户的 PPAP 审核,一期规划年产 10 万颗;中大力德的定增方案拟拿出 2.5 亿元,投向关节模组项目。两家公司都没有披露已经锁定的整机订单。临界点则称,OmniHand 系列累计交付已超过 1.5 万台。
▎ 无人车在封闭矿区已到千台规模,公开道路仍是百台量级,规划目标却写到上万辆
易控智驾的纯电无人矿卡已超过 1500 台,今年 3 月时是 800 台。国家能源集团准东露天煤矿投入了 120 台纯电无人矿卡,它们共用 28 个充电位。紫金矿业巨龙铜矿的 60 台无人矿卡在高海拔环境下常态运行,出勤率超过 90%。Volvo 的无人矿卡累计运送了 300 万吨物料,是当初 2025 年试点目标的三倍。
得州机动车管理局的记录显示,特斯拉获准商用的 Cybercab 数量,从 9 月 3 日的 45 辆增加到 10 月 2 日的 169 辆。Waymo 在得州获准商用的车辆为 1154 辆,全美投入商业运营的无人车超过 4000 辆。小马智行与 Verne 在萨格勒布启动了全无人载客测试,路线长 22 公里,目前不收费。Momenta 的 Robotaxi 车队眼下有 100 多辆,计划年底增至数百辆,2027 年底增至数千辆。彭博行业研究测算,小马智行和文远知行的车队利用率低于 Waymo,两家公司到 2028 年仍将亏损。
远期目标与眼下的约束之间,差距十分明显。Bolt 计划在欧洲投放至少 2.5 万辆 Lucid 无人车。但按欧盟现行规则,一款无人车型每年只能登记 1500 辆,而 Lucid 二季度一共只生产了 4774 辆。Aurora 把 2030 年的目标定在 3 万辆以上,其车队到今年底只有 200 辆,毛利盈亏平衡点也推迟到了 2027 年上半年。承运商 Werner 的首席信息官 Daragh Mahon 在同一场合表示:"坦白讲我们之间有差距。"Kodiak CEO Don Burnette 谈到得州的无人运营时说:"我们先从一辆开始,年底前放出第一辆。"
本周,监管方面也在补充责任条款。加州州长纽森签署了 SB 1246:Robotaxi 若阻挡警察或消防超过 30 分钟,运营方将被罚款;远程驾驶员必须身在美国,并持有美国驾照。NHTSA 则把 5 起事故和 3 人死亡,与 comma.ai 的后装辅助驾驶套件联系起来,这款套件已经装在逾 3 万辆车上。
上期看点回看
· 已发生|启元 Q1、T1 于 10 月 1 日在上海淮海中路的授权店交付了首批,深圳和杭州也同步交付。
· 未见更新|启元首批发货的台数,以及 2.1 亿元预收货款的兑现情况,公司都没有公布。
· 未见更新|乐聚的小脑基座模型原定 9 月底发布:本期既没有找到发布的消息,也没有找到真机指标。
· 未见更新|第七巡回上诉法院对 FMCSA 警示灯豁免的暂缓执行申请如何裁定:截至 10 月 2 日,法院还没有作出裁定。
· 延期|特斯拉原需在 9 月 30 日前向 NHTSA 宣誓答复 Cybercab 的认证依据:NHTSA 发言人对 CNBC 表示,特斯拉已获准延期;至于是否转而申请 Part 555 豁免,目前没有消息。
下周看点
· FMCSA 给 Aurora 的警示灯豁免将在 10 月 9 日到期:能否续发,第七巡回法院是否同时裁定暂缓。
· 明尼阿波利斯市议会关于无人网约车监护员的条例:表决结果如何,市长 Jacob Frey 是否否决。
· 特斯拉向 NHTSA 提交 Cybercab 的宣誓答复,新期限尚未披露:是否转而申请 Part 555 豁免(上期看点,未到期)。
FutureX · 记录未来如何发生
素材来源多方媒体/网络新闻