RobotsWiki
返回日报列表
2026年8月21日#68

Physical AI 日报 #68

原文: AI综合多源生成
今日要闻

2026上半年全球人形机器人出货超2.2万台、同比增长近300%,智元机器人独占约40%份额;宇树科技上市次日大跌18.70%、市值较首日盘中高点蒸发约1670亿元,同日发布9900元起的七轴仿生机械臂;Robotaxi全球化提速:百度Apollo Go接入Uber落地迪拜、小马智行开通欧洲首个Uber可呼叫Robotaxi服务(萨格勒布)、Waymo新一代Ojai车队三城全面铺开;研究方面,行为世界模型GigaBrain-WBC-0.5将人形机器人跌倒恢复率提升至99.3%,且从Unitree G1到Maker L01跨本体迁移成功

论文进展

GigaBrain-WBC-0.5:让人形全身控制策略"知道自己下一步能做什么"的行为世界模型

提出首个面向人形全身控制的行为世界模型,用因果Transformer联合预测下一动作、下一状态与潜在行为命令分布,部署时在线识别不可行命令并回拉至已学行为,让机器人"尽力执行"。在地形交互(成功率81.3%,为最强基线4.3倍)、不可行命令与跌倒恢复(99.3%,16.8倍于最强基线)等场景全面领先;在Unitree G1上训练的权重经简单微调即迁移至Maker L01实机。

world-modelhumanoidwhole-body-controlsim2real
关联机器人:Unitree G1maker-l01

用编码智能体重做Push-T:零演示数据,100%成功率

UC Berkeley Ken Goldberg团队让LLM编码智能体(Claude Code + Fable 5)自主编写算法方案,不使用任何人类演示。智能体自行找到在线2D仿真、通过实验推断推动动力学并迭代优化,以比200条演示训练的最优扩散策略少46%的步数达到100%成功率,还自动生成了Push-A至Push-Z的课程及Franka/UR5的3D跨本体仿真代码。其意义在于提示:相当一部分操作任务可能并不需要数据驱动策略。

agentic-roboticsmanipulationllmimitation-learning
关联机器人:frankaur5

ADEPT:先学会"摆正物体",再学一切难任务——多指灵巧手预训练范式

针对高自由度多指手每个新任务都需昂贵从零探索的问题,ADEPT先在通用物体重排任务上做大规模RL预训练,再以行为克隆蒸馏、critic热启动和保守在线更新的配方后训练下游策略,缓解微调中预训练能力快速退化的顽疾。蒸馏后的感知学生策略在23自由度Kuka-Allegro与29自由度Flexiv-Sharpa(含五通道视触觉)两种本体上实现零样本sim2real,以接近人类的速度完成困难初始状态下的长程任务。

manipulationdexterous-handpretrainingsim2real
关联机器人:kuka-allegroflexiv-sharpa

GS-VLA:相机挪一点,VLA成功率从90%跌到10%——用3D高斯规范化视角

现有VLA隐式假设训练与部署时相机配置一致,作者发现相机安装位置的微小偏移最坏情况下可使LIBERO成功率从约90%跌至约10%。该工作将视角偏移重构为局部新视角合成问题,在冻结的VLA前端接入一个400万参数的3D高斯规范化器,不触碰策略权重即可在多种架构、未见任务集与不同扰动尺度下恢复大部分性能损失。

vlarobustness3d-gaussian-splatting

机器人基础模型中的"具身鸿沟":泛化不等于能跑在你的机器人上

这篇综述为被scaling叙事所遮蔽的核心问题正式命名——可复用的模型、表征或数据与在特定目标机器人上实际执行之间存在的"具身鸿沟"。作者以"共享结构类型"和"需适配阶段"两个维度系统梳理现有方法(共享语义感知、共享数据接口、跨本体对应学习等),并提出适配成本的报告标准:只报成功率会掩盖换到新机器人时还剩多少工作。

vlasurveyfoundation-modelssim2real

SoftVTBench:任务完成≠没捏坏物体——可变形物体操作新基准

现有可变形物体操作评测只看任务成败,忽略滑动与过度挤压。该基准提供50+资产(含体积可变形物与视觉完全相同的刚性孪生体)、4000条专家演示,含20Hz同步多视角RGB、双指触觉图像与标记点运动等数据,并提出"变形感知成功率"DSR指标:任务完成且峰值变形在容差内才算成功。结果显示Diffusion Policy、π0.5和FastWAM在全部12个分布内配置中,均有0.7%–24%的"成功"实际违反了变形容差。

benchmarktactilemanipulationdeformable-objects

RoboEdit:将人类操作视频自动改写为动作一致的机器人视频

提出自动化流水线,将人类操作视频重写为动作一致的机器人视频,产出覆盖7种本体的17.4万对对齐视频对,为跨本体策略训练提供了新的大规模合成数据来源,直击具身智能最稀缺的高质量数据瓶颈。

data-generationcross-embodimentvideo-synthesis

商业化落地

Robotaxi全球化"三连发":百度登陆Uber迪拜、小马智行进驻萨格勒布、Waymo新车队三城铺开

百度Apollo Go正式接入Uber,迪拜用户呼叫UberX即可能被匹配到全无人驾驶车辆;小马智行与Uber合作在萨格勒布上线欧洲首个可通过Uber呼叫的Robotaxi服务;Waymo下一代Ojai车型在三城完成车队级部署,商业车队约300辆。中国玩家借道Uber加速出海,与Waymo形成全球三线并进格局。

robotaxiautonomous-drivinguberglobalization

宇树发布9900元起的七轴仿生机械臂,重复定位精度约0.1mm

宇树科技在上市第二个交易日同步推出七轴仿生机械臂,起售价人民币9900元,重复定位精度约0.1mm,延续其"高性能+激进定价"策略,进一步下探科研与开发者市场的人形配套上肢价格区间。

hardwarebionic-armhumanoidpricing

行业趋势

上半年全球人形机器人出货超2.2万台,同比增长近300%

最新数据显示2026年上半年全球人形机器人出货量突破22000台,同比接近300%增长;其中智元机器人一家独占约40%份额。从"发布会产品"到"批量交付",行业放量节奏显著加快,供应链与场景验证将成为下一阶段竞争焦点。

humanoidmarket-datashipment

融资与资本市场

宇树科技上市次日大跌18.70%,市值较首日高点蒸发约1670亿元

宇树科技上市第二个交易日股价下跌18.70%,较首日盘中高点市值缩水约1670亿元人民币。剧烈波动显示人形机器人第一股在极高估值预期下多空分歧加大,二级市场情绪对整个具身智能板块的融资环境或将产生传导效应。

unitreeipostock-markethumanoid
内容来源与版权声明

本日报由 AI 综合以下公开信息源自动生成:

  • AI综合多源生成
  • arXiv.org 开放获取论文
  • Hugging Face Daily Papers

原始内容版权归原作者所有。如有异议请联系本站