EMBODIED OUTPOST

具身前哨 · 第 78 期

2026年08月27日 · 共 20 篇

今日速览 · 20 条
  1. 1津村等企业联手引入人形机器人,AI“学校”正式启动
  2. 2具身AI投资火热,但机器人仍缺乏实用自主性
  3. 3新系统让人形机器人学会翻跟头、踢腿等动作
  4. 4特斯拉Optimus对决比亚迪小迪与LG CLOiD:英伟达入局AI机器人
  5. 5现代CEO:未来汽车经销商也能卖人形机器人
  6. 6从杂技到通用:人形机器人迎来发展拐点
  7. 7机器人奥运会:人形机器人百米8.64秒,比博尔特快近1秒
  8. 8BeyondMimic:引导扩散模型实现人形机器人通用控制
  9. 9XPolicyLab:机器人策略评估与部署的统一开放生态
  10. 10机器人世界模型真的遵循动作吗?诊断与对齐动作条件生成
  11. 11神经符号世界模型实现零样本任务迁移
  12. 12未来查询:大语言模型能否充当隐式医学世界模型?
  13. 13面向群体规模的多智能体世界建模
  14. 14探索长周期系外行星:开普勒发现4颗周期超342天的新候选体
  15. 15从生成到仿真:世界模型距离真正模拟器还有多远?
  16. 16ReWorld:具备长时记忆的交互式世界模型
  17. 17三星扩招63%机器人研发人才,加速人形机器人量产
  18. 18Agility Robotics借SPAC务实上市,重振俄勒冈科技
  19. 19宇树科技四日市值蒸发千亿,股价较首日高点回撤超44%
  20. 20全球人形机器人97%中国造,SAG统计揭示产业格局
1头条

津村等企业联手引入人形机器人,AI“学校”正式启动

humanoidgeneral_robotics
来源:日本人形机器人资讯 (Google News) · 原文链接 ⚠状态 0

日本汉方药巨头津村(Tsumura)与多家企业联手,正式启动面向人形机器人应用的AI“学校”,加速推进人形机器人在制药等场景的落地。该合作聚焦于将具身智能技术引入实际生产线,通过大规模数据采集与训练,提升机器人在复杂工业环境中的操作能力。津村方面表示,此举旨在解决制造业人力短缺问题,并探索人形机器人在精密药品处理环节的可行性。合作方将利用仿真到现实(sim-to-real)技术,结合强化学习与模仿学习,训练机器人执行抓取、搬运等精细任务。该项目被视为日本制造业拥抱具身智能的标志性动作,有望为全球人形机器人商业化提供可复制的工业范本。

2头条

具身AI投资火热,但机器人仍缺乏实用自主性

embodiedgeneral_robotics
来源:日本人形机器人资讯 (Google News) · 原文链接 ⚠状态 0

具身智能赛道持续升温,但机器人距离真正的商业化落地仍有距离。当前,资本正密集涌入具身AI领域,然而多数机器人系统在复杂真实环境中仍缺乏足够的自主决策能力,难以胜任非结构化任务。

技术层面,业界正加速融合强化学习、模仿学习与仿真到现实迁移,以突破运动控制与操作瓶颈。视觉-语言-动作模型(VLA)和世界模型成为新焦点,旨在赋予机器人更强的环境理解与任务规划能力。部分头部企业已在仓储物流场景部署自主移动机器人(AMR)与机械臂协同方案,将分拣效率提升约30%,但面对精密装配、灵巧抓取等泛化操作,现有系统的鲁棒性仍显不足。

商业层面,融资热度与落地难度形成鲜明反差。人形机器人公司估值屡创新高,但规模化交付案例寥寥。行业共识正从“炫技”转向“务实”,协作机器人与工业AGV的融合方案率先在汽车、3C电子制造中创造实际价值。未来18个月,能否在特定场景中实现端到端自主作业,将成为检验具身智能含金量的关键标尺。

3头条

新系统让人形机器人学会翻跟头、踢腿等动作

humanoidgeneral_robotics
来源:Interesting Engineering Robotics (Google News) · 原文链接 ⚠状态 0

新系统让人形机器人学会翻跟头、踢腿等复杂动作。该技术基于视觉-语言-动作模型(VLA),将人类演示视频转化为机器人的运动指令,无需传统编程或远程操作。测试中,机器人通过模仿学习掌握侧手翻、空翻和踢腿,动作成功率超过90%,且能适应不同地形。

该系统采用端到端架构,结合强化学习与仿真到现实(sim-to-real)迁移,大幅缩短训练时间。研究团队表示,这套方法可泛化至双足机器人、协作机器人(cobot)等平台,为具身智能(embodied AI)在工业巡检、物流分拣等场景的落地铺平道路。目前,相关代码已开源,多家机器人公司正评估将其集成至现有产品线。分析人士认为,该突破标志着运动控制(locomotion)与操作(manipulation)的融合进入新阶段,人形机器人商业化进程有望提速。

4

特斯拉Optimus对决比亚迪小迪与LG CLOiD:英伟达入局AI机器人

humanoidgeneral_robotics
来源:人形厂商动态 (Google News) · 原文链接 ⚠状态 0

Nvidia正式切入AI机器人赛道,其发布的Isaac GR00T基础模型同时支持Tesla Optimus、BYD Xiao Di与LG CLOiD等异构平台。该模型采用端到端视觉-语言-动作(VLA)架构,将仿真到现实(sim-to-real)迁移效率提升至传统强化学习的3倍,并内置世界模型以增强动态环境下的运动控制与灵巧抓取能力。此举意味着具身智能行业将告别碎片化开发,转向以基础模型为中枢的通用机器人操作系统范式,中小厂商可借此跳过底层算法积累,直接聚焦应用层创新。

5

现代CEO:未来汽车经销商也能卖人形机器人

humanoidgeneral_robotics
来源:人形厂商动态 (Google News) · 原文链接 ⚠状态 0

现代汽车CEO何塞·穆尼奥斯近日表示,未来人形机器人可能通过现有汽车经销商网络销售。现代旗下波士顿动力(Boston Dynamics)已推出商用人形机器人Atlas,并计划在2025年于现代工厂试点应用。此举将复用汽车零售渠道,降低机器人销售门槛,但人形机器人目前仍受限于成本与操作泛化能力,距离大规模商用尚需时日。

6

从杂技到通用:人形机器人迎来发展拐点

humanoidgeneral_robotics
来源:Science Robotics · 原文链接 ⚠状态 0

人形机器人正从炫技表演转向通用操作能力,行业进入拐点。宇树科技(Unitree)的G1机器人完成侧空翻,特斯拉(Tesla)Optimus已实现电池分拣,二者均采用端到端视觉-语言-动作(VLA)模型。相比传统运动控制与远程操作,新范式让机器人在未知环境中的抓取成功率提升至90%以上。这意味着具身智能从实验室走向工厂分拣、家庭服务等真实场景,但双足运动控制与灵巧操作的融合仍是瓶颈,仿真到现实(sim-to-real)迁移的稳定性决定商业化速度。

7

机器人奥运会:人形机器人百米8.64秒,比博尔特快近1秒

humanoidgeneral_robotics
来源:Reuters Robotics (Google News) · 原文链接 ⚠状态 0

全球首届机器人奥运会闭幕,一款双足人形机器人以8.64秒跑完100米,比博尔特的世界纪录快近1秒。赛事涵盖运动控制、抓取、远程操作等20余个项目,吸引超200支队伍参赛。这标志着具身智能在动态平衡与端到端运动控制上取得突破,但实验室成绩与复杂现实场景仍有距离,行业更需关注仿真到现实迁移的稳定性。

8

BeyondMimic:引导扩散模型实现人形机器人通用控制

humanoid
来源:Science Robotics · 原文链接 ⚠状态 0

BeyondMimic提出一种基于引导扩散的人形机器人控制框架,将运动追踪与多样化操作统一于同一模型。该系统无需重新训练即可切换双足运动、灵巧抓取和远程操作等任务,支持仿真到现实(sim-to-real)迁移。与依赖视觉-语言-动作模型(VLA)的端到端方案不同,BeyondMimic通过引导扩散显式解耦运动生成与任务约束,降低数据需求。这意味着人形机器人控制从专用策略走向通用基础模型,为具身智能提供更高效的运动控制底座。

9

XPolicyLab:机器人策略评估与部署的统一开放生态

embodiedgeneral_robotics
来源:arXiv cs.RO · 原文链接 ⚠状态 0

XPolicyLab发布了一个统一标准与开放生态系统,将机器人策略评估与部署的集成成本从O(NM)降至O(N+M)。该系统整合42种机器人策略,通过依赖隔离的客户端/服务器架构分离策略推理与环境执行,使模型特定代码差异达一个数量级,而环境端循环保持固定。实测中,符合标准将代表性策略集成时间从5小时以上降至2小时,打包技能进一步缩短至30分钟。同一适配器接口可服务RoboTwin、RoboDojo仿真及真实机器人评估。这意味着机器人具身智能行业首次有了可复现的策略对比与跨平台部署的共享基础设施,终结了模型间软件依赖碎片化导致的重复集成劳动。

10

机器人世界模型真的遵循动作吗?诊断与对齐动作条件生成

embodiedgeneral_robotics
来源:arXiv cs.RO · 原文链接 ⚠状态 0

机器人世界模型常被当作策略学习的仿真器,但其“生成未来是否忠实跟随任意动作”的假设从未被严格验证。新研究WorldEcho通过视觉完整性与SE(3)轨迹对齐,在更广动作分布上诊断发现:现有模型能执行专家动作,却难以应对离专家轨迹,常忽略指令或生成无效画面。为此提出的WorldSync从分布覆盖、表征接地和干预效应对齐三方面强化动作跟随,在RoboTwin基准和真实机器人任务中提升WorldEcho指标,并让迭代策略学习获得更高成功率。这意味着世界模型作为仿真器的可靠性有了可量化标尺,也为具身智能中的策略训练提供了更可信的闭环环境。

11

神经符号世界模型实现零样本任务迁移

embodied
来源:arXiv cs.LG (Machine Learning) · 原文链接 ⚠状态 0

利物浦大学团队提出神经符号世界模型,将奖励预测与观测重建解耦,使机器人策略在零样本条件下迁移至新任务。该方法在仿真环境中较纯神经方法展现出更强泛化性,无需额外环境交互即可适应同一符号状态空间的新奖励函数。这意味着具身智能体可摆脱任务绑定的潜在表征,向通用操作与运动控制迈出一步,但符号状态定义仍是跨场景落地的关键瓶颈。

12

未来查询:大语言模型能否充当隐式医学世界模型?

embodied
来源:arXiv cs.AI · 原文链接 ⚠状态 0

一项新研究提出“未来查询”(future querying)范式,测试大语言模型(LLM)能否充当隐式医学世界模型,直接回答患者未来的时间索引临床问题。该方法基于非结构化临床文档,采用端点无关训练,单个模型即可处理多种查询,无需人工特征工程。在合成医疗报告和MIMIC-IV真实ICU数据上,小型开源模型表现接近甚至媲美大型专有系统,支持隐私保护的本地部署。这意味着临床预测不再依赖任务专属流水线,LLM有望成为通用、可扩展的医学动态建模工具。

13

面向群体规模的多智能体世界建模

embodied
来源:arXiv cs.CV (Computer Vision) · 原文链接 ⚠状态 0

多智能体世界模型面临可扩展性瓶颈:现有方法在训练和推理时假设固定数量的智能体,无法在推理阶段动态扩展。来自学术团队的新框架Khora将世界状态演化与视觉渲染解耦,通过统一渲染接口查询共享世界状态,生成各智能体视角的观测,从而支持无需重训练即可扩展到任意数量智能体。实验显示,Khora在保持视觉质量和多智能体一致性的同时,计算开销随查询视角数量近似线性增长,并已实现实时交互系统用于开放世界模拟。这意味着具身智能仿真和机器人多机协作训练可摆脱预设智能体数量的限制,为大规模异构机器人集群的仿真到现实迁移提供了更灵活的基础模型方案。

14

探索长周期系外行星:开普勒发现4颗周期超342天的新候选体

humanoid
来源:arXiv cs.LG (Machine Learning) · 原文链接 ⚠状态 0

天文学家利用卷积神经网络和开普勒飞船诊断数据构建单次凌星检测管线,在已知多行星系统中发现4颗长周期行星候选体,轨道周期均超342天。其中Kepler 1752.02和Kepler 199.03分别产生两次凌星事件,周期约777.78天和505.495天,半径约3.55和2.74个地球半径;Kepler 1897.02和Kepler 1811.02为单次凌星候选体,半径约4.81和3.25个地球半径。这些候选体无法单独解释内行星的凌星时间变化(TTV),暗示系统中存在其他扰动行星。该工作填补了开普勒长周期行星探测的空白,为行星系统架构研究提供新样本,但需后续观测确认。

15

从生成到仿真:世界模型距离真正模拟器还有多远?

embodied
来源:arXiv cs.CV (Computer Vision) · 原文链接 ⚠状态 0

一项覆盖2018年至2026年6月共200篇论文的系统评估显示,生成式世界模型在交互性和可控性上已能替代传统模拟器,但在物理定律的形式化保证、结构化状态反馈和可复现的长时程演化上仍存差距。研究指出,163篇实现论文中仅6篇提供运行时状态查询接口,状态反馈是跨技术路线最被忽视的短板。该研究提出形式化物理、统一动作接口、一等状态反馈等六个方向,为具身智能依赖的仿真到现实(sim-to-real)训练提供评估基准,推动世界模型从内容生成走向可靠模拟器。

16

ReWorld:具备长时记忆的交互式世界模型

embodied
来源:arXiv cs.AI · 原文链接 ⚠状态 0

ReWorld(一种交互式世界模型)通过分离训练时的控制与记忆、推理时统一预算,解决了交互式世界模型“控制要短视、记忆要无限”的结构性矛盾。其混合注意力头与随机路由机制,配合姿态索引地标库的固定KV缓存,在64秒往返轨迹中仍能重建起始视图,而滑动窗口方法早已丢失证据。模型在704x1280分辨率下以四步采样实现实时流式生成,覆盖写实、游戏与风格化世界。在动作跟随、长时记忆与视频质量三维度测试中,ReWorld以11.95度旋转误差取得最优控制精度,优于六款近期模型。这意味着具身智能体可在固定算力下获得持久空间记忆,为长时程交互与导航任务提供了可落地的架构方案。

17

三星扩招63%机器人研发人才,加速人形机器人量产

humanoidgeneral_robotics
来源:日本人形机器人资讯 (Google News) · 原文链接 ⚠状态 0

三星电子(Samsung)将机器人研发团队人力扩充63%,加速人形机器人量产进程。此次扩编聚焦运动控制、灵巧抓取与端到端基础模型,目标直指2025年家庭服务场景落地。三星此举将推动具身智能从实验室走向消费级市场,与特斯拉Optimus、Figure等形成直接竞争,并带动上游传感器与执行器供应链升级。

18

Agility Robotics借SPAC务实上市,重振俄勒冈科技

humanoidgeneral_robotics
来源:人形厂商动态 (Google News) · 原文链接 ⚠状态 0

Agility Robotics正通过SPAC(特殊目的收购公司)上市,以务实路径重振俄勒冈州科技产业。这家公司以双足人形机器人Digit闻名,主打物流场景的移动操作能力。其技术路线强调仿真到现实(sim-to-real)迁移,结合强化学习提升运动控制,而非依赖昂贵的远程操作或端到端基础模型。此举意味着人形机器人商业化更侧重可落地的仓储应用,而非通用具身智能,为行业提供了一条区别于VLA大模型路线的务实样本。

19

宇树科技四日市值蒸发千亿,股价较首日高点回撤超44%

general_roboticshumanoid
来源:人形厂商动态 (Google News) · 原文链接 ⚠状态 0

宇树科技(Unitree Robotics)股价连续四个交易日下跌,市值蒸发近千亿元人民币,较上市首日高点回撤超44%。这家杭州人形机器人公司此前凭借消费级四足机器人和人形机器人产品登陆资本市场,一度成为具身智能概念龙头。此次回调直接冲击行业估值体系,市场对机器人公司高市盈率的容忍度正在收紧,后续融资和IPO定价将更依赖实际出货量与商业化进展,而非概念叙事。

20

全球人形机器人97%中国造,SAG统计揭示产业格局

humanoidgeneral_robotics
来源:日本人形机器人资讯 (Google News) · 原文链接 ⚠状态 0

全球人形机器人出货量近97%来自中国,SAG最新统计显示中国厂商主导市场。宇树科技、优必选等企业凭借低成本供应链和快速迭代,将双足机器人价格压至数万美元级别,而海外竞品普遍超10万美元。这一格局意味着具身智能的产业化重心已东移,中国在运动控制、端到端VLA模型等关键环节的工程化能力正转化为出货量优势,倒逼全球同行重新定位竞争策略。