Physical AI 日报

今日要点

· Enigma 出隐身即拿 7000 万美元种子轮,把 100 多台自研机器人开放给全网操控

· 曹操出行在杭州开放主驾无安全员 Robotaxi 测试,当地已部署百辆规模车队

· 缝制设备龙头杰克科技一次订下 2000 台人形机器人,联手西门子改造制衣产线

· 罗剑岚团队 τ0-VLA 把世界模型嵌进 VLA,25 步整理房间任务一次跑通

· 上半年手术机器人出口 4.8 亿元猛增 3.3 倍,机器人被列入外贸「新新三样」

一、论文进展

τ0-VLA:把世界模型塞进 VLA 的高层,让机器人「先想象再动手」 · vla

长程任务一直卡在累积误差和记忆不完备上——重复收同一件衣服、跳过「打开洗衣篮盖子」、做到一半偏离原指令。τ0-VLA 的做法是在双系统架构的慢思考层里塞进一个世界模型:提议模型给出多个候选子任务,世界模型想象每个子任务执行完画面会变成什么样,价值模型对想象出的未来打分并向后递归搜索,反思模型决定最终提交哪一条——关键设计是世界模型只预测、从不打分,否则等于让模型给自己的作品评分。这把大语言模型里常见的测试时计算搬到了具身,且只发生在子任务决策层而非低层动作层。论文设七项真机任务,在 Agibot G1 上跑通整理房间 25 步(约 8 分钟)、番茄炒蛋 22 步、备菜 14 步。

罗剑岚团队(上海创智学院 × 智元机器人具身中心)· 解读:具身纪元 原文

CD-LAM:世界模型画面很流畅,却常常无视你给的动作指令 · world-model

隐动作模型(LAM)本是为了让世界模型能在海量无标注人类视频上预训练,但 Aether AI 与 UC San Diego 的因果分析发现一个要命的漏洞:LAM 把背景、镜头移动、场景连续性一并编码进了「隐动作」,世界模型于是学会靠画面连续性猜下一帧的捷径——把动作全部置零,生成的机械臂照样在动。CD-LAM 不改世界模型主体,只在上游用具身中心重建、动作中心对比学习和隐空间校准三项目标净化隐动作表征,动作误差下降 30% 以上,且后训练只需 3k-6k 步微调、约为基线开销的 10%。团队还提出 FDCE 指标,因为 PSNR 与动作准确性几乎不相关。

Yufan Wei et al.(Aether AI × UC San Diego)· arXiv 2607.09185 https://arxiv.org/abs/2607.09185 · 解读:机器之心 原文

LDA-1B:让低质量数据也各司其职的世界模型 · world-model

高质量专家轨迹永远稀缺,LDA-1B 的思路是把异质数据分工使用:无动作标注的人类视频学视觉预测,低质量轨迹学 dynamics,高质量轨迹同时学策略与 dynamics。配套放出 EI-30k 数据集,约 3 万小时人类与机器人轨迹、真实与仿真混合并做了动作对齐。架构是多模态扩散 MoE Transformer,动作专家与视觉专家在自注意力处融合;借鉴 LeCun 的 JEPA 思路不做像素预测,改在 DINOv3 latent 空间监督。灵巧手操控实验中效果优于 Pi0.5 与英伟达 GR00T。

北京大学 × 银河通用机器人 × 中科院自动化所 × 智源 × 清华 × 中山大学 × NVIDIA · 解读:机器人解剖师 原文

Pigey:不重训策略,只给它加一层「工头」,LIBERO-PRO 直接翻四倍 · vla

当前主流做法是靠大规模预训练把感知、规划、成败判定、恢复全塞进一个策略里;这篇反其道而行,把能力拆成通用的语言条件控制策略 + 一个高层编排器。Pigey 做闭环规划、拆子目标、下发底层指令、从观测里核验结果并从失败中恢复,不需要任何额外数据采集或后训练就能驱动现成 VLA 策略。LIBERO-PRO 上从 12.8% 提到 53.3%,真机上把冻结策略在推理受限任务上从接近零抬到 90% 以上。作者把冻结运动技能单独执行与放进智能体循环之间的差距命名为「编排鸿沟」。

Liane Galanti, Dhruv Shah, Tri Dao · arXiv 2607.21725 https://arxiv.org/abs/2607.21725

Robot-Factored World Model:别让世界模型再去学「指令怎么变成动作」 · world-model

动作影响未来画面其实分两步——先由机器人本体和控制器实现为运动,场景再通过接触作出响应。直接拿动作指令做条件,等于逼世界模型把第一步也学了;拿记录下的未来状态做条件,又泄露了本该预测的交互结果。这篇把两个机器人特有的因子挪到模型外面:指令先过机器人自己的控制器与运动学得到标称轨迹,再通过 URDF 渲染成显式的机器人几何,模型只以「看得见的机器人几何」的形式感知动作。实验显示该接口优于向量条件基线,且能泛化到推理时未见过的本体,还能把人手演示重定向渲染成机器人几何来生成操作视频。

Byungjun Kim, Taeksoo Kim, Hyunsoo Cha, Hanbyul Joo · arXiv 2607.22535 https://arxiv.org/abs/2607.22535

ViTacWorld:用世界模型直接生成「视觉+触觉」轨迹 · world-model

接触密集操作依赖相机看不见的物理线索,但真实触觉数据采集昂贵、绑定硬件、场景单一。ViTacWorld 的关键观察是触觉信号直接锚定在物理接触上、sim2real 差距比纯视觉更小,因此可以用公开真实触觉数据加自建仿真环境放大数据量,先预训练再用真机策略 rollout 微调。给定动作后同时预测时序对齐的视觉观测与触觉反馈,一边合成 rollout 改进下游触觉策略,一边在受控动作序列下评估策略——作者称这是首个把世界模型用于视触觉-动作轨迹生成与策略评估的框架。

Yunao Huang et al. · arXiv 2607.22530 https://arxiv.org/abs/2607.22530

Xiaomi-Robotics-U0:让世界模型当训练经验的生产者,而不只是画面生成器 · world-model

具身数据扩展的难点从来不是画面数量,而是换了背景、光照、物体实例之后任务关系还在不在——同一物体在多相机下必须对应同一个三维场景,机械臂与物体的相对位置不能逐帧漂移。U0 用多模态自回归骨架,把普通图像任务、具身场景生成、跨场景迁移和具身视频生成放进同一个统一模型,并在标注阶段先拆出工作台/对象/光照/背景等语义字段,再依末端位姿与夹爪信号切分子任务与关键帧。与 GPT-Image-2 的对比集中在深度约束与多视角对应是否守得住,而非单帧好不好看。

Xiaomi Robotics 团队 · arXiv 2607.11643 https://arxiv.org/abs/2607.11643 · 解读:具身智能论文日记 原文

ACE-Brain-0.5:8B 骨干把空间感知、规划、操作与自我监控合进一个大脑 · vla

端到端 VLA 擅长出动作但短于空间推理与长程规划,基于 LLM 的机器人 Agent 能编排工具却学不到统一的机器人表征。ACE-Brain-0.5 用混合 Transformer 把五项认知功能收进单一模型,骨干参数量仅 8B,并引入双时间尺度控制接口——LLM 解码器低频处理语义规划,轻量快视觉通路高频把实时特征注入流匹配动作专家。为压住多任务异构数据联合训练的跨任务干扰,团队在原有 SSR 策略上加了「重新激活」阶段升级为 SSR+。LIBERO 平均成功率 98.2%、SimplerEnv-Bridge 82.3%。

Ziyang Gong et al.(ACE-Brain Team)· arXiv 2607.04426 https://arxiv.org/abs/2607.04426 · 解读:Green生态智能机器人 原文

其他今日论文:Ordered Action Tokens 给视觉运动策略设计带结构的有序动作 token,避开解析离散化过长与隐式 tokenizer 无结构两难(arXiv 2607.21670 https://arxiv.org/abs/2607.21670);ACME 发布跨文化、跨本体的社交导航数据集,补上地域与交互多样性缺口(arXiv 2607.21964 https://arxiv.org/abs/2607.21964);GRACE 把扩散策略与 MPPI 后验均值估计结合,无需可微引导代价即可满足碰撞检测、关节限位等硬约束(arXiv 2607.21661 https://arxiv.org/abs/2607.21661);Progress Reward Modeling 综述系统梳理机器人学习中的过程奖励设计(arXiv 2607.21655 https://arxiv.org/abs/2607.21655);SiPhy 从单张图像推理质量、刚度、弹性等物理属性(arXiv 2607.22355 https://arxiv.org/abs/2607.22355);Mag4D-SLAM 发布重复穿越的多模态 4D 地磁定位建图数据集(arXiv 2607.21986 https://arxiv.org/abs/2607.21986);一款皮肤覆盖机械臂的触觉「缩回反射」管线做了人因评估(arXiv 2607.22249 https://arxiv.org/abs/2607.22249)。

开源·工具·评测

· NVIDIA Cosmos-H-Dreams:手术世界模型蒸馏后在单张 RTX PRO 6000 上跑到约 160 fps(教师模型约 10 fps),权重与服务代码 7 月 23 日放出;底下没有物理引擎,直接从手术视频与机器人运动学学视觉动力学。训练集刻意保留了掉针、漏缝、打不牢的结等失败与分布外片段——用来给策略打分的模拟器必须能复现坏动作的后果。当前发布的 checkpoint 只做 da Vinci Research Kit 上的桌面缝合,288×512、指令频率 10 Hz https://www.unite.ai/nvidias-surgical-world-model-now-runs-live-on-one-gpu/

· 北京人形开源数据集:北京亦庄披露其具身智能开源数据集全球下载量突破千万 https://kfqgw.beijing.gov.cn/ywdt/gdcyfzgd/zncx/202607/t20260727_4791402.html

二、融资与交易

Enigma(美国/以色列)| 种子轮 | 7000 万美元 · embodied

Index Ventures 与 Ribbit Capital 领投,Conviction Partners 的 Sarah Guo 参投(公司通稿口径为 7100 万美元,TechCrunch 报道为 7000 万美元)。这家成立不足一年的研究实验室走了条和同行相反的路:别人在拼基座模型能力——扒网络视频、跑仿真、用带传感器的手套采人类动作——Enigma 研究的是人怎么和机器人交互,指望从中长出直觉式接口乃至另一种机器人大脑。配合出隐身,它把托管在以色列和加州机库里的100 多台自研机器人开放给全球任何人在线操控,能画画、持剑对打、拿烧瓶做简单化学实验,机械臂和底层模型均称为自研。两位创始人 Jonathan Jacobi(微软史上最年轻员工)与 Gal Niv 是少年黑客赛相识、以色列 8200 部队的战友,此前都不是机器人从业者。来源:TechCrunch https://techcrunch.com/2026/07/27/enigma-raises-70m-to-make-controlling-a-robot-as-easy-as-adjusting-the-volume/

智谷天厨(深圳)| 战略融资 | 近亿元 · adjacent

招商局创投领投,跃迁资本跟投,云启资本、啟赋资本等老股东超额追投。这家 2018 年成立的智能烹饪机器人公司在一众具身企业里罕见地营收破亿且已实现盈利,预计 2026 年营收较 2025 年保持 300% 增速;产品已进智能制造、养老、校园食堂、快餐连锁等业态,近期落地某全球最大新能源主机厂的后勤食堂,并在北京地区学校食堂批量铺开。2025 年底以来海外客户日均拜访量增约三倍、签单转化率超 50%,产品已落地欧洲、北美、澳洲、东南亚及日韩。公司即将更名为「仟弈智能」。来源:机器人前瞻 原文

正奇未来| 8 个月三轮天使系列 | 数亿元 · autonomy

核心资方为鼎晖 VGC 投资、线性资本,产业方包括上汽集团恒旭资本、柏睿资本、正轩投资及周大福投资,老股东持续追投并超募。创始人吴书林在华为工作 15 年、曾任百度智能驾驶事业群副总裁,切入的是 Door-to-Door 短途移动任务——从卧室到电梯、走廊到社区小路这段「城市交通毛细血管」。其判断是短途出行占人类出行总量 70% 以上,智驾渗透率却几乎为零,而机动车道上的自动驾驶已投入数千亿只覆盖了那 30% 的结构化场景。产品线是 QUORRA 品牌短途出行机器人,配自研 DoorMind 世界模型与四轮独立转向的 FLAT 运动平台;首款 QUORRA X5 已拿下海外十多个国家和地区的商业订单,年内开天猫、京东旗舰店。来源:融中财经 原文

斯坦德机器人(无锡)| 第三次递表港交所 · industrial

中信证券、国泰海通为联席保荐人。按 2025 年销量计为中国第四大工业智能移动机器人解决方案提供商,市场份额 4.0%;截至 7 月 23 日解决方案获全球超 400 名客户采用,3C 领域排名第二、汽车第三、半导体第五。财务上收益从 2023 年 1.62 亿元增至 2025 年 3.01 亿元,但亏损同期从 1 亿元收窄至 4514.4 万元后又扩大到 2.02 亿元,2026 年前四个月收益 1.07 亿元、亏损 6183.5 万元。来源:智通财经 https://cj.sina.cn/articles/view/5835524730/15bd30a7a020027ykm

领湖智能(深圳)| 新一轮 | 数千万元 · hardware

海愿资本独家投资,资金投向关节模组与多型号电机的研发迭代及产能扩张。2016 年成立,产品覆盖关节模组、教育机器人、工业机器人与微型电机,电机含空心杯、永磁同步、无框力矩、直流无刷全品类,其超小直径空心杯电机已具备量产能力并大量用于灵巧手。目前已与优必选等企业达成合作。来源:机器人前瞻 原文

Axis Robotics(美国)| 新一轮 | 1200 万美元 · adjacent

资金用于构建面向物理 AI 的复利式数据引擎。来源:Yellow.com https://yellow.com/press-releases/axis-robotics-12m-seed-round-physical-ai

三、商业化落地与部署

曹操出行开放主驾无安全员 Robotaxi 测试,杭州已部署百辆车队 · autonomy

曹操出行7 月 27 日宣布正式开放 Robotaxi 主驾无安全员测试,在杭州市滨江区真实城市道路开展,采用特定站点触发派单的机制,在小规模可控条件下验证无安全员运营的稳定性。所有测试车已接入「曹操智行 RAS 远程安全服务平台」,承担全程安全监控、紧急呼叫响应、远程实时协助与异常处置。今年 4 月该公司已获批成为杭州首家可开展无安全员智能网联汽车道路测试的企业,目前在杭州部署了百辆规模的 Robotaxi 车队,配套的「绿色智能通行岛」集自动换电、自动清洁、车辆整备于一体。作为吉利控股 Robox 战略的商业化载体,其参与定义研发的中国首款原生开发 Robotaxi EvaCab 已亮相,计划 2027 年量产替代当前改装车。放在本周语境里,这是继东风启辰×哈啰 HR1 量产交付、香港首张全无人牌照之后,国内 Robotaxi 从「有牌照」向「去掉安全员」推进的又一步。来源:盖世汽车 https://car.tom.com/202607/1753711568.html

杰克科技一次订购 2000 台人形机器人,联手西门子改造服装制造 · industrial

中国工业缝纫机制造商杰克科技正与西门子合作,把 AI、数字工程与人形机器人整合进服装生产,目标是把制造效率提升至少 30%(效率数字为公司设定目标)。作为这一推进的一部分,杰克科技已订购 2000 台面向服装制造定制的人形机器人,公司称这是该行业首批大规模人形部署之一——订单的供应商与交付节奏未披露。服装是典型的劳动密集、批量小交期短的场景,人形之所以被看中,是因为它能直接进入为人设计的工位、沿用现有工具设备而不需大改产线。同一篇报道还提到西门子德国埃尔朗根电子工厂的一次两周试点:一台轮式人形每小时搬运 60 个料箱、可处理两种尺寸、日运行 8 小时以上、自主抓放成功率超 90%——⚠️ 演示口径,两周试点的时长与规模都还不构成量产指标。来源:Interesting Engineering https://interestingengineering.com/ai-robotics/china-humanoid-robots-textile-manufacturing

Value Truck 将部署 Aurora 第二代无人驾驶卡车 · autonomy

继 7 月 22 日 Aurora 在美推出第二代无人驾驶卡车后,本次公告落到了客户侧——货运公司 Value Truck 宣布将部署该代车型,车队规模与投放时间表未在公告中披露。来源:Business Wire https://www.businesswire.com/news/home/20260727903588/en/Value-Truck-to-Deploy-Auroras-Second-Generation-Driverless-Trucks

Momenta Robovan 落地苏州,同一套世界模型从乘用车铺到无人物流车 · autonomy

Momenta 的 Robovan 在苏州开跑,标志其世界模型基座平台从乘用车、Robotaxi 延伸到 Robovan。该公司今年 4 月量产首发 R7 世界模型,路线是用同一套大模型支撑乘用车、Robovan、Robotruck 与 Robotaxi 的规模化——这与多数玩家按车型分栈的做法相反。来源:新浪财经 https://finance.sina.cn/2026-07-27/detail-inikfxcf0711449.d.html?vt=4

BAUHOUS 引入 XYZ Robotics 自动化整个收货流程 · industrial

德国建材零售商 BAUHAUSXYZ Robotics(星猿哲)达成合作,将其收货环节全流程自动化。收货是仓储自动化里长期被绕开的一环——来料箱型杂、无固定序列,对通用抓取能力要求高于成品拣选。来源:Yahoo Finance https://finance.yahoo.com/technology/articles/bauhaus-partners-xyz-robotics-automate-080000025.html

盖特威克机场下月上线英国首个机器人泊车服务 · adjacent

伦敦盖特威克机场与法国 Stanley Robotics 合作,下月在南航站楼推出全自动机器人泊车:车主停进指定车位后,机器人平台滑入车底、托起轮胎把车运往安全停车区,钥匙始终不交出。机场称系统兼容至多 95% 的车型,进出由车牌识别控制、全天候监控。真正的账不在体验而在土地——机器人能把车停得比人更密,不扩建设施就能提高容量。Stanley Robotics 此前已在法国里昂机场落地,巴塞尔-米卢斯机场也将跟进。来源:Secret London https://secretldn.com/gatwick-airport-uks-first-robot-parking-service/

四、产业动态

机器人被列入外贸「新新三样」:手术机器人出口猛增 3.3 倍,市场从 23 国扩到 49 国 · adjacent

据央视财经,机器人、人工智能、创新药正崛起为中国外贸的「新新三样」。海关口径下,上半年清洁机器人和智能仿生机器人合计出口 180.9 亿元;工业机器人出口 62.9 亿元、增长 18.6%,销往全球 141 个国家和地区;手术机器人出口 4.8 亿元,猛增 3.3 倍,出口市场从 23 个扩大到 49 个——增速最快的恰是单价最高、认证门槛最硬的那一类。企查查数据显示,截至 7 月 27 日国内现存机器人相关企业 119.94 万家,2025 年全年注册量首次突破 20 万家、达 27.77 万家同比增 39%,今年已注册 15.55 万家、同比增 19.24%;超半数企业成立于近三年,成立 1-3 年的占比最高达 29.33%。这组数字的另一面是行业结构极年轻,出清尚未开始。来源:观点网 https://www.guandian.cn/article/20260727/577300.html

特斯拉为 Optimus 部门买下首套 Virtuix 全身模拟系统 · humanoid

Virtuix(NASDAQ: VTIX)宣布特斯拉为其 Optimus 人形机器人部门采购了首套 Omni One Enterprise 系统——这是该产品的首笔企业订单。Omni One 是一台全向跑步机,让使用者在紧凑占地内自然行走穿越虚拟环境,官方列出的适用场景包括训练、仿真以及人形机器人的遥操作。Virtuix 此前的合作方多在消费、国防与医疗侧,包括 Meta、NASA 和美军四大军种。采购金额未披露,特斯拉方面亦未说明具体用途。来源:Yahoo Finance https://uk.finance.yahoo.com/news/virtuix-sells-first-enterprise-system-131700761.html

Waymo 的城市摩擦账单:奥斯汀停车罚单累计 9325 美元,旧金山市长要求收紧规则 · autonomy

Waymo 在奥斯汀的无人车累计产生 9325 美元停车罚款,同期洛杉矶一起涉及 Waymo 的事故造成多人受伤,旧金山市长则在交通秩序混乱后要求对其施加更严格规则。这类账单单看金额不大,但它是 Robotaxi 从「能不能跑」进入「能不能长期占用城市公共空间」阶段后,第一批可量化的外部成本。来源:新浪财经 https://finance.sina.com.cn/tech/roll/2026-07-27/doc-inikfxaw8423913.shtml、InsideEVs https://insideevs.com/news/802842/waymo-robotaxi-austin-parking-tickets/

波士顿动力把 Google Cloud 的 Gemini 嵌进 Spot · embodied

波士顿动力将 Google Cloud 的 Gemini 接入四足机器人 Spot。Spot 的主战场是工业巡检——本周它刚进驻 Copper One 铜矿做自主巡检——把多模态大模型接进去,指向的是把「按预设路线走一遍」变成「听懂现场指令再判断看什么」。来源:MarketScale https://www.marketscale.com/industries/software-and-technology/boston-dynamics-embeds-google-clouds-gemini-into-spot-while-anthropic-pursues-samsung-chips-and-a-fall-ipo

智元赴港 IPO 续:三年营收从 30 万元走到 10.5 亿元,五大业务已各自分拆融资 · humanoid

继 7 月 24 日正式启动赴港上市后,本期披露的是其财务与组织底盘(已报)。董事长邓泰华今年 4 月曾透露,成立三年来营收从第一年 30 万元到第二年 6000 多万元,2025 年突破 10.5 亿元。组织上从 2025 年 4 月起,智元把灵巧手、数据采集、租赁服务、四足机器狗、商业清洁五大板块全部分拆为独立子公司,每家均已完成独立融资。⚠️ 单方口径估值信息(约 200 亿美元推进 IPO、基石目标 400-500 亿港元)仍未获公司确认。来源:东方财富 https://finance.eastmoney.com/a/202607273822330361.html

比亚迪人形机器人定名「小迪」,8 月初郑州首秀 · humanoid

继上周官宣入局后,比亚迪公布了首款人形机器人的名称与规格:身高 1.61 米、重 58.5 公斤、31 个运动自由度,手部可完成精细抓取,搭载多模态感知系统支持多语种与方言交流,定位展厅智能导购,承担迎宾、车型讲解等任务,8 月初在郑州首次公众亮相。海外报道称其规划为每家门店配置两台。来源:猫头鹰人形机器人 原文、汽车之家 https://chejiahao.autohome.com.cn/info/26070708

宇树王兴兴:机器人进家庭还要 5 到 10 年 · humanoid

王兴兴在受访时表示,机器人像普通家电一样走进千家万户需要 5 到 10 年,最需要慢慢适应的是安全性与伦理问题。⚠️ 表态口径——值得对照的是他本月早些时候「具身智能 ChatGPT 时刻最快两三年到来」的判断,两者说的分别是技术拐点与家庭渗透。来源:中国新闻网 https://m.sohu.com/a/1055442694_355158?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334

硬件·供应链

· 谐波减速器:普华永道《2026 年智能机器人产业发展白皮书》称国产化率已超 75%,推动行业成本年均下降 16% 以上;白皮书同时给出替代经济性锚点——焊接机器人年均综合使用成本约 5-8 万元,远低于焊工 12-15 万元的综合用工成本,并判断规模化应用分三波、第三波(半技能制造场景)的落地时间完全取决于具身智能技术突破速度 https://www.guandian.cn/m/show/577052

· 空心杯电机:领湖智能披露其空心杯电机启动机械时间常数小于 28 毫秒、部分产品 10 毫秒以内,能量转换效率 70% 以上、部分突破 90%,对照传统铁芯电机的 20-50% 原文

· 汇川技术:在接受调研时表示人形机器人是公司重点战略业务,基于工业自动化积累已完成核心零部件开发,推出无框力矩电机、低压高功率驱动器、直线/旋转执行器 原文

· 韩国零部件国产化:韩国正推动人形机器人零部件本土化以填补供应链缺口,执行器厂商 Robotis 押注这一环节抢量产窗口 https://biz.chosun.com/en/en-industry/2026/07/27/AJCZQ225JFDOTFUPRXCPTD2AV4/?outputType=amphttps://biz.chosun.com/en/en-industry/2026/07/27/E2H4Q7GO7JCCNFJTNMWEASCM2Y/

· 灵巧手传动:雷赛智能子公司灵巧驱控公布《一种手指模块、机械手及机器人》专利,指向高自由度与强抓取力难以兼顾的老痛点 原文