X Square 的 WALL-B 机器人直播分拣 1,816 件/小时,准确率超 98%,比 Figure 机器人 5 月耐力测试的 1,248 件/小时高出约 45%。其采用双臂与专用夹爪而非人形本体,连续重规划应对包裹遮挡、变形等变化。该模型正拓展至家庭场景,但泛化能力仍需验证。
Our livestream has wrapped-and the final result is in: 1,816 randomly selected parcels sorted per hour, with a success r...
LG 与 NVIDIA 签署谅解备忘录,双方多领域 AI 合作转入执行阶段。LG 计划 2027Q1 公开亮相基于 Jetson Thor 芯片的双足人形机器人,并将在 2028H1 建成 80MW AI 工厂。
H2R-Bench 提出用于评估跨具身人到机器人操作视频生成的基准,要求模型将第一视角人类演示转换为指定具身下的机器人操作视频。基准涵盖目标状态完成、动作事件完成、功能接触迁移、具身正确性和视频质量五个维度,并评测了六个操作族、两种机器人具身上的十一个最新视频生成模型。结果显示当前视频世界模型在具身一致性、功能交互和任务执行上仍存在明显不足。
《人形机器人试验方法》系列国家标准启动会8月13日在武汉光谷举行,总则、环境感知、决策规划、运动控制等7项标准同步启动编制,宇树科技、小米机器人等头部企业和高校的200多名代表参会。会上,湖北省人形机器人与具身智能标准工作组揭牌成立,首批委员涵盖29家单位。全国机器人标委会人形机器人分委会秘书长刘新表示,试验方法相当于国家认可的“考试大纲”,标准先立起来产业才能真正跑起来。
Spatial Memory Agent(SMA)提出一种无需参数更新的空间推理自进化框架,通过验证器引导的反思将空间经验蒸馏为可迁移教训,并分配可校准的迁移可靠性评分(TRS)。在五个空间基准和四个基础VLM上,SMA在每个基础模型组中均取得最高宏平均准确率,在20项评测中多数达到最佳精度,为冻结模型的空间自进化提供了实用路径。
DreamX-Phi 1.0 是一个面向机器人操作的动作条件视频世界模型,输入观测帧、语言指令及动作序列即可预测未来观测。该模型通过 PRoPE 式几何编码注入每臂 SE(3) 变换,并引入深度分支与 SAM3 掩码保持物体一致性,同时用分布匹配蒸馏实现高效部署。
小马智行与优步 Uber 扩大战略合作,将在欧洲 5 个城市部署超过 2000 辆小马智行 Robotaxi,并在克罗地亚萨格勒布现有商业化运营基础上扩展。萨格勒布服务即将接入 Uber 平台,用户可通过 Uber App 呼叫车辆。小马智行提供 L4 级自动驾驶技术,Uber 提供出行平台支持,双方还将深化中东合作。
文远知行发布 2026 年第二季度及上半年财报,上半年总营收 3.5 亿元,同比增长 73%;第二季度营收 2.3 亿元,同比增长 82%、环比增长 103%,毛利率升至 37.5%。上半年海外收入同比增长 154%,业务已覆盖 13 国 60 余城。截至 7 月 31 日,全球 L4 车队约 3,400 辆,其中 Robotaxi 超 1,800 辆。
Introducing Cues: Voice & Gesture control for Matic We raised $115M and spent 9 years to make the world's first intuitiv...
Introducing Cues: Voice & Gesture control for Matic We raised $115M and spent 9 years to make the world's first intuitiv...
Matic 将特斯拉的视觉优先路线用于家用扫地机器人:配备五颗 RGB-IR 摄像头、无 LiDAR,由 NVIDIA Jetson Orin 板载推理,实时更新 3D 地图以区分充电线、袜子和宠物。团队耗时 7 年、不足 100 人打造,获 1.15 亿美元融资,支持 75 种语言,WIRED 给出 10/10 评分。
Introducing Cues: Voice & Gesture control for Matic We raised $115M and spent 9 years to make the world's first intuitiv...
AWS 开源的 Strands Robots(Apache 2.0)通过单一智能体循环,将机器人演示记录、基于 Hub 数据流的策略训练及硬件部署整合在一起,全程保持 LeRobot 磁盘格式不变。
NVIDIA 研究副总裁刘明宇(Ming-Yu Liu)做客播客,深入解析 Cosmos 系列世界模型,重点谈及近期发布的 Cosmos 3、面向物理世界的 AI 及 NVIDIA 的竞争与技术趋势判断。他常以东方智慧类比技术,如用《孙子兵法》思考世界模型路线,并分享个人习武与冰浴习惯。
第二届世界人形机器人运动会将于8月22日在国家速滑馆“冰丝带”开赛,共吸引六大洲16个国家的666支队伍、2056台机器人参赛,队伍总量同比增长138%。赛事打造“机器人之家”运动员村,配备“一机一码”数字化管理,30秒完成存取登记,并已接入全部666支赛队、2056台机器人的运行数据。充电区设200个充电柜,可同时满足不少于1200块电池的充电需求。
Dyna Robotics 发布 Dyna-2,一个在超100万小时第一人称人类视频上预训练的世界-动作模型(WAM),用于机器人操作。研究团队验证了从1,000到1,000,000小时数据的缩放定律,并首次将该定律零样本迁移至未见过的机器人数据;视频联合去噪在39/39任务上优于仅动作训练,将零样本机器人MSE从0.340降至0.120。
Hand Visibility Detector 首次将手部关节可见性估计作为独立任务系统研究,利用大规模预训练 HPE 模型作为骨干网络实现高精度估计。在下游 3D 手部姿态标注任务中,基于可见性加权的多视角三角化降低了重投影误差。该方法已作为即用型包发布,代码与演示已公开。
具身智能公司 Dyna Robotics 发布机器人基础模型 DYNA-2,基于超 100 万小时第一人称人类视频预训练,任务成功率最高达 90%。该模型通过预测下一帧画面及应采取动作,补足传统视觉语言模型缺失的空间推理与接触物理能力。
第二届世界人形机器人运动会将于8月22日在国家速滑馆“冰丝带”开幕,吸引六大洲16国666支队伍、2056台机器人参赛,队伍总量同比增长138%,机器人数量翻了两番。赛事设51个项目共1301场比赛,赛期从首届3天增至5天,并取消外围赛,将武术、舞蹈等对抗性项目纳入竞技赛。竞赛标准全面升级,100米完赛时间从3分钟压缩至1分钟,除障碍赛外所有径赛均须机器人全自主完成。
荣耀在今晚发布会上宣布将参加8月22日至26日在北京“冰丝带”举办的第二届世界人形机器人运动会,赛事设50个赛项,含29项竞技赛和21项场景赛,并首次增设拔河项目。荣耀自研的齐天大圣队人形机器人“闪电”曾在今年4月的北京亦庄半马中以50分26秒夺冠,并包揽该赛事前六名。
荣耀 Robot Phone 正式发布,定价 9999 元起,天马微电子独家供应屏幕。该机配备 6.31 英寸 1.5K OLED 直屏,峰值亮度 6800nits,支持 1-120Hz LTPO 自适应刷新率与 4320Hz 超高频 PWM 调光,并集成荣耀 AI 绿洲护眼等十余项护眼技术。
8月20日晚将举办一场围绕具身智能的线下交流活动,主题聚焦于“模型越来越聪明,具身智能还差什么”。活动面向关注具身智能发展的从业者与爱好者,邀请参与者共同探讨当前技术进展与瓶颈。
比亚迪汽车新技术研究院 AI 团队发布首篇研究论文,推出用于自动驾驶的混合世界模型 HyWorldVLA,结合像素级与潜在空间世界建模,采用视觉-语言-动作(VLA)架构。
荣耀在今晚的全球新品发布会上正式推出全球首款机器人手机——荣耀 Robot Phone。该机将 4DoF 机械臂装入机身,采用行业最小全钛云台架构、行业最轻及最快钛合金云台电机,并配备行业最强盾构钢翻转电机。荣耀称这是一次勇敢尝试,代表其探索 AI 终端未来的决心。
宇树科技今日宣布,旗下仿生双足人形机器人累计生产下线约 18000 台。截至 2026 年 5 月,单款双足人形机器人(G1)累计下线约 11000 台,5 月至 8 月新增约 7000 台,月均产量显著提升。2026 年上半年宇树出货约 5900 台,占全球 31% 市场份额。
前阿里 Qwen 负责人林俊旸在上海创立 Pragmatik Labs,专注横跨数字与物理世界的下一代智能体。他于三月离开阿里,新实验室已获 HSG 与腾讯投资,估值达 20 亿美元。Pragmatik Labs 计划将前沿 AI 研究引入物理世界,并通过真实部署迭代模型。
2026 中国算力大会将于 9 月 11 日至 13 日在河北廊坊举行,以“共织算力网 智启新未来”为主题,采用“1+2+X+Y”总体架构。大会首次举办“算力首创首发发布会”,将集中发布一批首创首发算力软硬件新品,重点展示国产算力芯片、智能体、绿色算力等成果。同期举办的“算力中国·AI 与算力产业展览会”及成果展示、公开论坛等活动面向公众免费开放。
2026 年,ego 正成为具身行业更主流的数据来源。文章以“分包、崩老太和跨国套利”三个关键词,勾勒出当前数据采集行业的生态与乱象,揭示具身智能领域对数据需求的增长及其背后的市场运作方式。
论文提出 Combodied Agents 范式,将数字智能体与具身智能体统一为以人为中心的闭环系统,通过感知、建模、预测并支持个体状态轨迹,而非仅改变软件或物理状态。框架整合个人助理、健康智能体、AI 伴侣等能力,采用事件感知、纵向可纠正记忆、个人世界模型与合规干预策略,并强调保留用户自主性的评估指标与治理方向。
日本文部科学省《科学技术指标 2026》显示,2024 年中国研发经费达 97.1 万亿日元(约合 4.12 万亿元人民币),同比增长 13.1%,首次超过美国的 95.3 万亿日元。中国在热点论文数(占全球 53.2%)及 6 个学科被引次数上保持世界第一;集邦咨询预测 2026 年国产产品有望拿下中国高端 AI 芯片市场近 90% 份额,上半年中国人形机器人出货量占全球 97%。
林俊旸今日宣布在上海创办 AI 公司 Pragmatik Labs(语用科技),简称 p7k,研究方向为横跨数字世界和物理世界的下一代智能体(Agent)。高榕创投和红杉中国共同领投本轮融资,腾讯和上海未来产业基金提供支持。据 The Information 报道,此轮融资规模达数亿美元,投后估值约 20 亿美元。
LTX 发布 LTX-2.5,一个面向视频生成、实时应用和物理 AI 的开源权重世界模型,针对 NVIDIA RTX GPU 和 DGX Spark 本地推理优化,降低了 VRAM 需求。
同一事件,精选展示《LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI》小鹏汽车智能中心负责人刘先明接受专访,详解VLA 2.0实际能力、自动驾驶仍存在的短板及该技术进入欧洲的时间表。小鹏正基于统一AI底座布局自动驾驶、Robotaxi、人形机器人与飞行汽车,转型为Physical AI公司。访谈还探讨了同一AI底座控制多类载体时,车企与AI公司的边界何在。