Riemann-1.0:将机器人策略与世界模拟器压缩进单一因果自回归模型
将多视角观测、机器人状态与本体动作统一放入单一因果序列,同一套权重既可在线执行策略、又能作为多本体视觉模拟器。基于超20万小时混合交互数据(第一人称人类视频、手持夹爪演示、异构机器人轨迹)做渐进式本体预训练,真机长程操作成功率达85.0%、过程成功率94.4%;仿真中RoboTwin2.0为94.3%、LIBERO为99.0%。
Riemann-1.0将机器人策略与世界模拟器压缩进单一因果自回归模型,真机长程操作成功率85%,高出最强开源基线15个百分点;优必选上半年人形机器人销量16,123台,全尺寸机型营收同比增长1,445%;Anthropic发布硬件MCP,AI智能体可直接控制实验仪器与产线设备;国家发改委为机器人热潮降温,警示防止盲目跟风与一拥而上
将多视角观测、机器人状态与本体动作统一放入单一因果序列,同一套权重既可在线执行策略、又能作为多本体视觉模拟器。基于超20万小时混合交互数据(第一人称人类视频、手持夹爪演示、异构机器人轨迹)做渐进式本体预训练,真机长程操作成功率达85.0%、过程成功率94.4%;仿真中RoboTwin2.0为94.3%、LIBERO为99.0%。
将具身轨迹写成观测与动作交替的因果序列,按尺度由粗到细生成未来帧,并配合尺度压缩的长程记忆:近期交互保留细粒度,远期观测与动作被压缩以保持记忆有界。作者报告了超过一分钟的连贯流式rollout,并通过在线策略对齐抑制动作漂移与长时程不一致。
动作条件视频模型通常被锁定在单一本体上,导致互联网规模的人类视频无法利用。CLAP用末端执行器位姿、语言指令和潜动作三种表示调和不同动作空间,先在无标注视频上学物理先验,再接地到末端动作空间实现零样本部署;在DROID上接近或超过单本体SOTA,覆盖Bridge、双臂YAM与G1人形等本体,代码与模型全部开源。
针对稠密地形重建抹平关键细节、逐帧模仿缺乏时序信用分配这两大长程失效根源,SOLO用傅里叶编码网格查询从深度与本体感知token中提取证据,将高程图L1误差降至基线的1/4至1/3,并把师生下一状态散度写入PPO奖励。压力测试地形平均通过率97.5%、踏石地形96%,而稠密重建版本仅0-3%。
大型VLA主导操作榜单,但语言条件控制到底需要多少参数?PredVLA仅0.68M可训练参数、完全不使用机器人数据预训练,靠分层生成式循环动力学预测视觉特征与本体感知,观测仅通过预测误差的在线推断影响隐状态。在LIBERO三个短程套件平均86.9%,相同前端、数据与评测协议下超参数匹配的Transformer策略3.7倍、超LSTM 7.4倍。
a16z新募11亿美元基金,延续“美国活力”主题,重点投向AI的物理基础设施。这标志着顶级风投持续加码从比特走向原子的AI叙事,具身智能与物理世界自动化是核心受益方向。
中国人形机器人厂商优必选上半年售出16,123台人形机器人,其中全尺寸机型营收同比暴增1,445%。这一数据表明人形机器人正从展厅演示走向批量交付,规模化商用拐点或已临近。
Anthropic推出面向硬件的MCP协议,使AI智能体能够直接操作实验仪器和生产线设备。这为LLM智能体进入物理世界提供了标准化接口层,实验室自动化与工业场景的Agent落地有望加速。
国家发改委明确表态为机器人产业热潮降温,要求防止盲目跟风和羊群效应。在优必选销量暴增、资本大举涌入的背景下,监管层的审慎信号值得产业链各方关注,行业或将进入去泡沫与真本事比拼阶段。
安全研究人员在宇树G1 EDU上发现两个root级漏洞,其中一条攻击链从蓝牙入口发起。随着人形机器人规模化部署进入工厂与家庭,其底层系统的攻击面正成为不可忽视的安全债务,厂商需在放量之前补齐安全工程能力。
以往针对VLA的后门攻击把任何任务失败都视为攻击成功,而TrapVLA提出“配置失败陷阱”:攻击者必须精确控制失败模式本身,例如让抓取按指定距离偏移,这大幅抬高了检测门槛。作者构建了Trap-LIBERO与Trap-RoboTwin两个基准、覆盖四类失败模式,并显式学习触发器诱导的动作残差;仿真与真机实验中,模型在干净数据上的性能基本保持,隐蔽性极强。与同日曝光的G1漏洞对照阅读,具身智能的安全防线建设已刻不容缓。
本日报由 AI 综合以下公开信息源自动生成:
原始内容版权归原作者所有。如有异议请联系本站。