━━━━━ 正文从此处全选复制 ━━━━━

FutureX · Physical AI

今日要点

· 小鹏 Robotaxi 定名「悠游」并开放内测,广州试点车队近 100 辆

· 特斯拉在欧洲把 FSD 改名 TAD(辅助驾驶),欧盟全区投票推迟到最早 12 月

· 速腾聚创三季度卖出机器人等领域激光雷达 14.52 万台,同比增 309%

· ARC 不新增一条机器人示范,把 π0.5 的真机任务成功率拉高 82.2 个百分点

· VioLA 训练帧 93.2% 来自人类,行走类指令真机零样本成功率 100%

· 广东定下 2028 年人形机器人年产 8 万台的目标

▎ 论文进展

ARC:为机器人基础模型配上一套推理方案 · vla

要让机器人基础模型变强,常见做法是扩大模型规模、增加示范数量。ARC 没有走这条路,它不采集任何新数据,只调整模型的推理方式。其推理链必须落到下一步动作上,既要说明这一步为什么合适,也要说明预期会带来什么效果。这类标注由 DROID 已有的示范自动生成,随后用于微调 π0.5 和 Cosmos3-Nano-Policy。在真机上,π0.5 的任务成功率提高了 82.2 个百分点;在 RoboLab-Reasoning-50 上,最高提升为 50 个百分点。[1]

VioLA:以人类数据训练人形通用策略,真机上零样本行走 · locomotion

过去,人形通用策略要部署到真机,都得针对每个任务,用遥操作示范逐一微调。VioLA 改变了预测的目标:策略输出的是身体和手部动作的隐变量,再交给预训练控制器去执行。人和机器人的动作被编码到同一个隐空间里,所以人类录像可以直接充当训练标签。1.406 亿帧的训练池中,有 93.2% 来自人类。行走类指令在真机上的零样本成功率为 100%,GR00T N1.7 是 16.7%,Ψ0 是 0%。操作任务没有经过针对性微调,成功率也达到 88.6%。作者表示,代码与权重将会放出。[2]

3 万小时第一视角视频,没能教会世界模型什么 · world-model

作者把第一视角的人类视频增加到 3 万小时,涵盖逾 1000 类场景、1.4 万名采集者,并在分布外场景中直接衡量模型对人体与物体交互的还原程度。数据量扩大 100 倍后,两项指标都有所上升,但人体建模已接近饱和,物体还原度明显低得多,增长也更慢。有一种监督方式,是让模型容量从场景外观转向物体动力学,它能缩小这一差距,不过差距依然很大。[3]

DreamTrue:以反事实后训练,让机器人世界模型更准确地跟随动作 · world-model

机器人数据集中失败的交互很少,世界模型因此倾向于预测成功。DreamTrue 先改写已记录的动作轨迹,生成更多接触情形下的未来视频;再用一个视频奖励模型做强化学习后训练,该奖励模型以人工标注的缺陷数据训练而成。在 AgiBot 数据上,人工评估的交互缺陷率由 48.12% 降到 6.25%,并获得 AgiBot World Challenge 2026 世界模型赛道第一名;HF 33↑。[4]

SuperNav:无需导航微调的智能体式导航系统 · autonomy

HF 62↑,是今日社区热度最高的一篇。SuperNav 没有对多模态大模型做导航微调,而是为它配了一层智能体外壳,内含导航技能、物理交互工具和任务进度管理。模型直接在图像上标出目的地,并根据执行反馈作出修正。在实例级、多目标和需求驱动三类任务上,它都胜过 4 个基线,还部署到了真实的四足机器人上。[5]

Embodied Turing Machines:测试时不用模型,完全以代码充当策略 · manipulation

COAP 通过代码,从图像和本体感知中追踪机器人、环境与任务的状态,所有决策也都由代码做出。各任务共用的代码库,则由编码智能体不断改写和扩充。在 RoboDojo 的 42 项双臂任务上,这套代码库的成功率为 70.24%,而测试时的回路中没有 VLM 或 VLA。星动纪元的 VPP2 在同一基准上以 32.26% 位居第一,它声明自己没有使用 Agent RSI;这篇论文走的恰恰是 RSI 路线,所以两个分数不适合直接对比。HF 6↑。[6]

SpatialHarness:补充渲染视角,让冻结的 GPT-6 Astra 完成精细操作 · manipulation

GPT-6 Astra 这类前沿多模态模型已经可以直接控制机器人,但在精细操作上经常失败。作者判断,原因是相机没能拍清关键的空间关系。为此,他们在线维护一个与真机同步的仿真场景,把渲染出的补充视角提供给冻结的模型,既不改动策略,也不增加相机。同样是 GPT-6 Astra,插头插入的成功率由 26.7% 升到 66.7%,汉诺塔则从 0 升到 100%。[7]

百万级并行环境中的强化学习:采样应紧扣能力边界 · manipulation

在大规模并行仿真中,如果对任务配置做均匀采样,越来越多的算力会耗在策略已经掌握或暂时够不着的配置上。SGS(成功引导采样)则把训练集中在策略能力边界附近。它在多达 2^20(逾百万)个并行环境下,解决了此前方法解决不了的多地形四足运动和接触密集型装配问题;经蒸馏得到 RGB 策略后,又零样本迁移到真机装配上。[8]

其他今日论文:
· SimVLA(只用仿真数据训练移动操作 VLA,零样本上真机,表现胜过以 50 条真机示范训练的策略,[9])
· HT-Policies(采用异方差 Student-t 回归,单次前向的回归策略追平了 flow 生成式策略,[10])
· 动态布料操作变异性(同一条轨迹重复十次,结果的差异比机器人自身的重复误差高出 1-3 个数量级,四款模拟器都无法复现,数据集已公开,[11])
· Being-M0.7(人形隐式世界-动作模型,从人类视频和动作数据中迁移先验,[12])
· USDCraft(由 LLM 编写程序,生成可仿真的铰接 3D 资产,HF 12↑,[13])
· Task Scrubbing(不同 VLM 骨干对视觉捷径的敏感程度差别很大,该工作用对抗训练来压制捷径,[14])
· LAC-WM(在跨本体之间共享隐动作空间的机器人世界模型,[15])
· LeWAM(JEPA 世界动作模型,搭配扩散引导的 MPC,[16])
· WAM-Cache(跨动作块复用 KV,无需训练即可加速世界动作模型,[17])
· UNITAS(3D 原生的世界动作模型,[18])
· NavGPT-3(分层导航运行时,由语言模型负责推理、VLA 负责执行,[19])
· Dex-One2Many(从单条人类示范学习灵巧操作,并泛化到新的位姿,[20])

开源·工具·评测

· VPP2(星动纪元):世界动作模型 VPP2 在 RoboDojo 仿真榜(42 项双臂任务)上排名第一,平均成功率为 32.26%,平均得分为 39.26;该榜由港大 MMLab 牵头,近 20 家机构共建。GPT-6 Astra 经后训练的评测成绩是 22.48% 和 28.97。代码和项目主页同时开源,基座模型是阿里开源的 Wan2.1-I2V-14B。星动纪元还表示,他们在真机 ALOHA 上做了 10 类零样本任务,平均成功率 58.5%,π0.5 为 40%;这组真机数据目前仅为厂商自测。 [21] [22]

· RoboChallenge 真机测 GPT-6 Astra:原力灵机把 GPT-6 Astra 接入了 Table30 V2 真机评测,该评测由原力灵机与 Hugging Face 共同发起。四种本体各测一项任务,每项测 10 次。叠碗和找绿块的成功率为 100%,盖章为 80%,碎纸为 70%,后两项的公开最高记录都是 50%。但有三项得分低于公开最高分,而且双臂任务还以平台参考轨迹作为上下文。 [23]

· TouchScale:Texas A&M、Google DeepMind、CMU、Stanford 等 15 家机构发布了 500 小时的人手视触觉数据集,数据全部由同一套穿戴设备采集。仅用这些人类数据做中期训练,机器人在 4 项真机接触任务上的平均成功率就从 22.5% 升到了 57.5%。 [24]

· LET-HumanMotion-Roban2:乐聚与青瞳视觉通过 OpenLET 社区开源了人形动作数据集,涵盖 800 多类、数万条动作。数据集已重定向并适配乐聚鲁班2,同时附有数据转换和训练工具链。 [25]

▎ 融资与交易

Ultra(美国)| A 轮 | 5000 万美元 | 估值未披露 · embodied

本轮由 Framework Ventures 领投,Y Combinator 参投。加上此前 1200 万美元的种子轮,融资累计达 6200 万美元。Ultra 成立于 2024 年,产品是固定式双臂机器人 OP1,按月租给电商仓库,用于打包、分拣和组套。公司同时扩大了与 Physical Intelligence 的合作,由后者提供 VLA 模型。据公司称,其机器人已打包超过 50 万单,在布鲁克林的 Highline Commerce 承担至多三成的履约量。[26]

本溯智能 | 种子轮 | 金额未披露 | 估值未披露 · world-model

本轮由五源资本领投,常春藤资本、线性资本和华山资本参投。公司由八名清北背景的研究者于 2026 年 7 月创办,研发动作原生的具身基础模型。其跨本体模型 X-VLA 的预训练数据不足 1000 小时,却在 400 多支队伍中夺得 IROS 2025 智元挑战赛冠军。[27]

扩散智能(深圳)| 连续两轮 | 合计数亿元 | 估值未披露 · adjacent

经纬创投、顺为资本和君联资本联合领投,HW哈勃、中科创星和地平线跟投。公司成立于 2026 年 5 月,创始团队由港大 NLP 实验室联合主管孔令鹏及其博士生龚珊三、叶佳成组成。公司研发扩散语言模型(dLLM,即可以并行生成、并能回头修改已生成内容的语言模型),目前正在训练 300 亿参数的模型,面向端侧 Agent 和机器人任务规划。在与 Acrab 的适配测试中,双方称端侧 Agent 的运行速度提升了 5 倍。[28]

简智机器人 | 百度、银河通用入股 | 金额未披露 · embodied

天眼查信息显示,其关联公司简智新创(北京)机器人科技新增了北京百度网讯和银河通用旗下的苏州盖博特为股东,注册资本从约 19.3 万元增加到约 1052.4 万元。该公司成立于 2025 年 5 月,经营范围包括服务消费机器人的制造与销售。[29]

壁仞科技 | 战略投资 | 5.15 亿美元 · hardware

出资方是瑞银资产和中金公司,亿欧数据在 10 月 8 日披露了这一消息。壁仞是上海的高性能计算方案商。当天智能科技领域披露的融资总额约为 40.77 亿元,这一笔占去了其中的大部分。[30]

▎ 商业化落地与部署

小鹏 Robotaxi 定名「悠游」,广州近百辆车开始内测 · autonomy

10 月 8 日,小鹏将其 Robotaxi 业务定名为「小鹏悠游 XPENG YOYO」,同时上线了小程序,并陆续放出用户内测名额。所用车辆是小鹏 GX 的 Robotaxi 版本,搭载 4 颗自研图灵晶片,有效算力为 3000 TOPS,运行第二代 VLA。小鹏今年 1 月拿到广州的道路测试许可,5 月首台量产车下线,7 月启动内测;到 8 月为止,广州累计的内测订单已超过 2000 次。小鹏副董事长兼总裁顾宏地对 CNA 表示,广州试点车队有近 100 辆,"从明年开始,我们希望在部分海外城市启动试点"。何小鹏提出的目标是 2027 年实现无安全员的载客运营,广州业务最早在 2027 年下半年做到单车盈亏平衡。同一篇报道还给出一个参照:萝卜快跑的全球累计订单已超过 2200 万单。[31]

易控智驾:600 多台无人矿卡投入采煤环节 · autonomy

9 月底,易控智驾曾报告纯电无人矿卡已超过 1500 台,这一次又披露了采煤场景的数据。截至 9 月,在新疆和内蒙古 10 多座露天煤矿从事采煤作业的无人矿卡超过 600 台,累计采煤运输量超过 2 亿吨。新疆的一座矿山 2023 年冬天首批投入 24 台,现在增加到 111 台,对接 6 个破碎站,单个站点每小时接卸 35 车以上,效率与人工驾驶相当。国能扎尼河露天矿的 5 台 90 吨级车辆,单车日均装载量由 4500 吨提高到 7200 吨,人工干预则降到每百公里 1.3 次。[32]

Exotec Skypod 在 First Supply 运行一年,次日达订单最多占日订单量两成 · industrial

美国暖通与建材批发商 First Supply 位于威斯康星州 West Salem 的配送中心,已使用 Exotec Skypod 系统一年多。下午 5 点前下的订单,可在次日上午送达。这类次日订单最多占到该中心日订单量的 20%。首席物流官 Steve Baer 表示,有了 Skypod,公司就能应对旺季,也能应对每天的订单高峰。[33]

新石器的深圳夜间配送已扩展到 437 条线路 · autonomy ⚠️ 厂商口径

深圳在 3 月放开了无人配送车的夜间路权,此后新石器的夜间配送已扩展到 437 条线路,彭博社以此为例写了一篇特写。创始人余恩源对彭博社说:"无人配送车做的是人们不想做、不愿做或不能做的工作。"公司称,其在 15 个国家的 300 个城市运营着逾 2.7 万辆车。[34]

小马智行与 Uber 将第七代 Robotaxi 带往伦敦 · autonomy ⚠️ 计划口径

继萨格勒布之后,双方在 10 月 8 日宣布推进伦敦项目,道路测试预计在未来几周内开始。根据两家公司 8 月公布的计划,他们要在欧洲 5 座城市投放超过 2000 辆 Robotaxi。[35]

Skild AI 的四足机器人在匹兹堡机场开始为期半年的试岗 · world-model

匹兹堡国际机场借助 xBridge 创新项目,安排 4 台运行 Skild AI 软件的四足机器人在航站楼内巡查。它们先检测空气质量,再去发现地面上的泼洒和已经满溢的垃圾桶。试点持续六个月,Skild 会派人员驻场监看。[36]

▎ 产业动态

特斯拉在欧洲把 FSD 更名为 TAD,欧盟投票推迟 · autonomy

特斯拉德国官网已将 FSD 监督版改称为 TAD(Tesla Assisted Driving,特斯拉辅助驾驶),比利时和丹麦的官网也同步做了调整。德国联邦交通部在 10 月 6 日发表声明,称更名是特斯拉提出的,目的是回应 FSD 这一名称可能引起的误解;德方支持推动该系统进入欧盟的审批程序。原定于 10 月 6 日举行的欧盟全区投票已经推迟,最早要到 12 月,届时特斯拉需要争取至少 15 个成员国的支持,并达到特定多数。荷兰、立陶宛、爱沙尼亚、比利时、丹麦、斯洛文尼亚、捷克和克罗地亚这 8 国,已经批准了相关功能。中国区在 5 月就改用了"特斯拉辅助驾驶"的名称,推送时间仍未确定。[37]

广东提出 2028 年人形机器人年产 8 万台的目标 · humanoid

广东省工信厅一级巡视员吴红在 9 日的全省先进制造业大会上表示,广东力争到 2028 年让人形机器人的年产量突破 8 万台,并使规上制造业企业的 AI 应用普及率超过 50%。她预计,2026 年广东的人形机器人产量约占全国的三分之一,今年进入工厂"打工"的人形机器人有望突破 3000 台。据 IFR 统计,2025 年全球售出的商用与专业用途全尺寸人形机器人约 7000 台;那是销量,这里说的是产量,口径不同,8 万台大约是它的 11 倍。优必选董事长周剑在会上说:"人形机器人的价值不在于外形像人,而在于能走进工厂、拿起工具、完成真实作业。"[38]

优必选与一汽-大众签署战略合作协议,开展厂内物流应用 · humanoid

10 月 8 日,优必选宣布与一汽-大众展开合作,在物流领域开发并测试具身智能机器人的应用场景,具体的合作形式没有公开。两家公司在 2024 年就曾在一汽-大众青岛分公司合作,当时 Walker S Lite 进入工厂实训,承担车辆质检工作。优必选 2025 年的全尺寸人形机器人收入为 8.2 亿元,销量为 1079 台。[39]

比亚迪人形机器人「小迪」的外观专利获得授权 · humanoid

外观设计专利 CN 310247768 S 已由国家知识产权局公示,专利权人是比亚迪,授权公告日为 10 月 6 日,产品名称是"具身智能机器人"。这是比亚迪自研人形机器人的外观首次正式公开,对应的是代号为「小迪」的机型:身高 1.61 米,体重 58.5 公斤,全身有 31 个自由度,定位于门店的商用服务。比亚迪执行副总裁李柯此前表示,目标是每家门店配置 2 至 3 台。[40]

人形机器人日租金跌破千元,工业机器人却在涨价 · humanoid

据《科创板日报》报道,人形机器人的日租金,已从去年年初的万元级降到今年年初的 2000 至 3000 元,现在更是跌破千元;闲鱼上有商家把宇树人形机器人的租赁起步价标为 289 元/天。整机售价同样在下降:松延动力"小布米"的官方售价为 9998 元,宇树 R1 则从 3.99 万元降到了 2.99 万元。宇树的招股书显示,其人形机器人单价从 2023 年的 59.34 万元降到 2025 年的 16.64 万元。工业机器人的走势正好相反:汇川技术自 3 月起,把 SCARA 和多关节机器人提价 5% 至 15%,埃夫特年内已两次提价,两家给出的理由都是铜、铝和存储晶片涨价。[41]

训练场超过 70 个,报告测算单靠卖数据回本需三年以上 · adjacent

中国信通院等机构发布了《具身智能训练场研究报告(2026年)》。报告统计,截至 6 月底,全国运营中的具身训练场超过 70 个,另有 46 个处于规划或建设阶段,其中 86% 覆盖工业制造场景。建设一个数千平方米的综合训练场,投入可达数千万元至上亿元。报告测算,若投入 5000 万元、年产 10 万小时数据并且全部卖出,仅靠卖数据也要三年以上才能回本。海外机器人数据公司 Eidon AI 已经停止运营。创始人 Sam Padilla 复盘时说,团队花了约五个月,拿到约 3000 小时的数据,而"实验室需要的不是一次性的数据集,而是可靠、持续的数据供应"。[42]

英国拨款 4000 万英镑,建设 8 个机器人应用中心 · adjacent

英国政府宣布,将在全国设立 8 个机器人应用中心,合计获得 4000 万英镑,用来帮助企业和公共部门采用自动化。其中,纽卡斯尔的中心面向机器人辅助手术,林肯的中心面向农业和食品行业。政府另外拨款 250 万英镑,支持 12 个机器人培训与学徒项目。AI 与机器人大臣 Kanishka Narayan 表示,各行业用上机器人,能够"加快英国再工业化"。[43]

Helm.ai 称 12 个月内签下 7000 万美元合同 · autonomy ⚠️ 厂商口径

自动驾驶基础模型公司 Helm.ai 宣布,在过去 12 个月里,它与全球车企、Tier 1 和工业自动化公司签下了 7000 万美元的商业合同,并称公司正在走向经营盈亏平衡。合同的明细和客户名单均未披露。[44]

硬件·供应链

· 速腾聚创:三季度激光雷达总销量为 59.56 万台,同比增长 220.9%,其中机器人及其他领域为 14.52 万台,同比增长 309.0%。前三季度累计销量 131.48 万台,已经超过 2025 全年的 91.20 万台。机器人业务的客户超过 3400 家,包括宇树、智元、石头等。公司还表示,触觉传感器将在今年四季度量产,关节模组则在四季度启动批量交付。 [45]

· 谐波减速器与丝杠价格:GGII 的报告显示,绿的谐波同等性能的谐波减速器报价稳定在 1320 元左右,而🇯🇵哈默纳科的同型号产品仍在 3000 至 4000 元。来福谐波的招股书显示,其均价由 2023 年的 802 元/台降到 2025 年的 573 元/台。双林股份在 1 月披露,C3 精度行星滚柱丝杠的量产定价为 499 元/根。 [46]

· 洛轴股份:该公司在互动平台上表示,配套工业机器人和具身机器人的部分轴承,已经在进行客户验证并小批量供货,尚未形成大规模的销售收入。 [47]

· GlobalFoundries FDX Fusion:格芯在德累斯顿投资 11 亿欧元的 SPRINT 扩产项目已于 9 日封顶,到 2028 年底,年产能将超过 100 万片 300mm 晶圆。格芯同时宣布,将在当地开发并制造 FDX Fusion,这是面向 Physical AI 的下一代 FD-SOI 平台。 [48]

· 特斯拉触觉专利:特斯拉于 2025 年 9 月 11 日提交的一份专利申请已经公开,其中描述了一种能贴合手指和手掌曲面的柔性触觉传感层,电路有电容式和电阻式两种,申请文件里没有点名 Optimus。Not a Tesla App 援引 The Information 报道称,特斯拉 8 月每周生产数百台机器人,主要供内部使用,但手工组装难度大,触觉传感器的耐久性也存在问题。 [49]

文中 [N] 为来源编号,全部来源链接请点文末「阅读原文」查看。

FutureX · 记录未来如何发生

素材来源多方媒体/网络新闻