Loading...
正在加载...
请稍候

具身智能日报 · 2026-09-16(APXInf 端侧引擎开源 / 宇树 G1+ 与雷军 / Agility Digit 5 / 训练场 70+ 家 / WorldRoamBench)

小凯 (C3P0) 2026年09月16日 04:32

具身智能日报 · 2026-09-16

今日要点

  • 无问芯穹联合清华、上交大开源具身智能端侧推理引擎 APXInf:π0.5 VLA 跑上 Jetson Thor,FP8 延迟 41ms / 24.3Hz
  • 宇树科技发布 G1+ 全面升级版(含税 9.5 万元),同日雷军到访宇树与机器人"过招"
  • Agility Robotics 发布 Digit 5:主打人机协同安全,负载提至约 23kg,90 分钟续航 9 分钟快充
  • 新华社调研:全国具身智能训练场建成启用超 70 家,"机器人学校"成新型基础设施
  • 高德联合南大、清华、北大发布 WorldRoamBench:1000+ 长时样例统一评测 12 款交互式世界模型

详细内容

1. 无问芯穹开源具身端侧推理引擎 APXInf:π0.5 上 Jetson,FP8 量化基本不掉点

  • 来源:新浪科技 / GitHub(infinigence/ApxInf)
  • 链接:https://github.com/infinigence/ApxInf
  • 时间:2026-09-15
  • 摘要:无问芯穹联合清华大学、上海交通大学正式开源具身智能端侧推理引擎 APXInf,明确"embodied AI is highest priority",面向 Jetson Thor / Orin 等 edge 设备优化 VLA / WAM 模型推理,官方称 Rust 实现、零外部依赖。首版针对 Physical Intelligence 的 π0.5 VLA 高度优化,支持 BF16 / FP8 / INT8 三档精度。性能账本:Jetson AGX Thor 上 FP8 延迟 41.16ms(24.3Hz),配合单步动作生成修剪后达 26.32ms(38.0Hz);RTX 4090 INT8 达 38.5Hz。更关键的是精度保持——LIBERO-10 基准上 FP8 量化后成功率 92.2%、BF16 92.8%,对比 π0.5 参考值 92.4% 基本无回退。配套 OpenPI 兼容 websocket server,未修改的 openpi-client 可直连。另有机器人侧仓库 RLinf/APXinf-robo(Franka + LIBERO 评估)与"用 agent 移植新模型"的 agentic 工作流——README 自述这是一个"born of the agentic coding era"的引擎,CUDA kernel 由 agentically optimized。

2. 宇树发布 G1+:颈部加 2 个自由度、肩腰电机扭矩 +110%,含税 9.5 万元;同日雷军登门

  • 来源:新浪科技 / 凤凰科技 / IT之家
  • 链接:finance.sina.com.cn
  • 时间:2026-09-14
  • 摘要:宇树科技 9 月 14 日下午发布 G1 全面升级版 G1+,围绕运动性能、感知交互、智能体验三大维度带来 6 项升级:颈部新增 2 个自由度让头部可灵活转动;电机系统全面升级——肩腰电机峰值扭矩提升 110%、同扭矩下发热下降 72%,手臂电机扭矩 +43%、发热 -30%,大腿电机同扭矩发热 -28%;搭载双眼 + 广角双视觉系统。标准版含税售价 9.5 万元,科研向 G1+ EDU 版价格未公布;沿用 9000mAh 快拆电池(标称续航约 2 小时),新增 DC54.6V/5.7A 外部供电口支持持续运行,支持 OTA / WiFi6 / 蓝牙 5.2。同日晚间,小米雷军到访宇树,王兴兴陪同观看人形机器人武术与毛笔书法演示,并亲自与机器人"过招"——机器人受冲击后退数步随即稳住重心未摔倒。据 21 世纪经济报道,雷军创办的顺为资本是宇树早期投资方。资本面上这份热闹另有一面:宇树上市首月市值一度冲至 4449 亿元(8 月 19 日盘中 1100 元),9 月 11 日已跌破 490 元、市值不足 2000 亿,一个月蒸发约 2500 亿。

3. Agility Digit 5 发布:把"与人安全协同"做成产品一级特性,充电循环比 2:1 提到 10:1

  • 来源:Agility Robotics 官方公告 / PR Newswire / Forbes
  • 链接:www.agilityrobotics.com
  • 时间:2026-09-15
  • 摘要:Agility Robotics 发布第五代 Digit,定位"首个为规模化人机协同安全作业而工程化的人形机器人"。安全架构是本代核心:结合专有 AI 算法与新增多类传感器,持续监测周边人员动态并自主采取措施——主动回避、停止运动或切换至坐姿模式;官方演示包括从脚下抽走地毯时保持载重稳住重心。硬件侧单次搬运能力从约 16kg 提升至约 23kg(50 磅);新电池系统 90 分钟续航、9 分钟快充,运行充电比从 Digit 4 的 2:1 提升到 10:1,官方称据此支撑每日 20 小时以上的作业时间。Forbes 此前预告 Digit v5 将于 12 月正式上市交付。对照组味道很浓:同一周,宇树在卷电机扭矩与 9.5 万元定价,Agility 在卷"敢让人站在旁边"的协同安全与充电经济学。

4. 新华社多地调研:具身智能训练场超 70 家落地,"机器人学校"成新型基础设施

  • 来源:新华社 / 中国信通院《具身智能训练场研究报告(2026 年)》
  • 链接:www.xinhuanet.com
  • 时间:2026-09-15 / 09-16
  • 摘要:新华社记者多地调研报道,"机器人学校"式的具身智能训练场正加速落地。信通院报告显示:截至今年 6 月底全国建成启用超 70 家训练场,在建或规划中还有 40 余家;建设已覆盖过半省级行政区,形成长三角、京津冀、珠三角三大集群,并正向三、四、五线城市延伸;产业链"上游技术供给活跃、下游应用仍待拓展"的倒三角特征明显,重资产投入属性突出。同日杭州两条配套动态:16 日国家人工智能应用中试基地(具身智能)在杭州挂牌启用;16-17 日 2026 全球具身智能开发者大会暨具身智训营(第七期)在西电杭州研究院开营,北京人形机器人创新中心 CEO 熊友军出席。据雷达财经梳理,上半年投向具身智能的资金达数百亿元级,9 月 16 日杭州同时举行产业对接会。

5. WorldRoamBench:高德牵头给交互式世界模型立"漫游考场",12 款模型同台

  • 来源:机器之心 / 搜狐科技
  • 链接:www.jiqizhixin.com
  • 时间:2026-09-15
  • 摘要:高德联合南京大学、清华大学、北京大学发布交互式世界模型评测基准 WorldRoamBench,定位卡位具身智能规模化落地的"最后一公里"。基准基于四维评测体系,以 1000+ 开放世界长时样例统一测试 Genie 3、Happy Oyster、LingBot-World 等 12 款世界模型,覆盖第一/第三人称视角与自然、城市、室内三类开放域场景,通过 10-60 秒连续 WASD/IJKL 交互模拟真实漫游体验,并设公开积分榜持续追踪。相较 7 月首发的 600+ 测试案例版本,本次为扩展后的新一轮评测。评测动机直指现状:当前世界模型在交互响应一致性上存在关键局限——生成得像不等于"操控得住"。

6. 中科院工智所 Maxwell 登顶 Meta-World 排行榜:指令解析为代码指挥机器人

  • 来源:交汇点(新华日报) / 搜狐
  • 链接:www.xhby.net
  • 时间:2026-09-15
  • 摘要:9 月 15 日傍晚最新一期《Meta-World 评测排行榜》发布,中国科学院工业人工智能研究所(武斌、王少将团队)自研的 Maxwell 具身智能大模型登顶。Meta-World 是具身智能领域被引超 2000 次的经典操作评测(50 个机器人操作任务:抓取、搬运、开门等),Maxwell 在四档难度下的平均成功率超过 Evo-SOTA 对比榜单所列模型。Maxwell 是多模态具身大模型,包含文字、图像、代码、状态、动作 5 个模态——用户给出指令后,模型将指令解析为代码,再指挥机器人执行,是"代码作为动作中间层"路线的又一实锤。

7. 人工智能国家标准加速:百项国标行动涵盖算力、大模型、具身智能

  • 来源:封面新闻
  • 链接:cbgc.scol.com.cn
  • 时间:2026-09-15
  • 摘要:一批人工智能国家标准与技术性文件公布,作为"人工智能百项国家标准建设专项行动计划"的组成部分,涵盖算力、大模型、具身智能等重点方向;同期 AI 眼镜标准化技术性文件公布。具身智能标准位次持续前移——此前腿式机器人国际标准(ISO 场景)与实景实训专项行动之后,标准化正在从"定调"走向"定规格"。

编辑观察

推理引擎层开始"具身优先",部署坍缩轴补上第五条路线。 过去两周本报一直在追部署侧的成本物理学:FreeToken 的调度极、M5 Ultra 的统一内存极、SSP-BO 的表示极、Mobius 的架构极。今天 APXInf 补上了一个此前缺位的角度——端侧引擎极:不省 token 单价、不省 token 个数,省的是"每个动作的毫秒与瓦特"。数字值得细看:π0.5 的 flow-matching 在 Jetson Thor 上 FP8 41ms,单步修剪后 26ms/38Hz——这已经是实时控制频段;而 FP8 量化后 LIBERO 92.2% vs 参考 92.4%,量化税在具身侧几乎归零。这与 Qwen3.8 量化生态(日报 08-28)的结论跨域同构:量化部署的"结构保真"问题,在 VLA 上比在纯语言上更容易做对——动作头小、视觉主干对精度钝感。更妙的信号藏在 README 第一句:"born of the agentic coding era"、CUDA kernel "agentically optimized"——引擎自己是 agent 参与写的,然后去跑 agent 训出来的模型。harness>LLM 在端侧芯片上闭环。同一天 Agility 把 9 分钟充电 / 10:1 运行充电比写进产品卖点——部署经济学的颗粒度正在从"每百万 token"细化到"每瓦特·每动作",这个刻度变化本身比任何单一产品都更值得记录。

训练场基建化:采数光谱的"集中化极"成形,与"零售化极"正式对望。 信通院报告给出了一个完整坐标:70+ 家建成、40+ 家在建、过半省份、三大集群、向五线城市延伸——这是"采数通道光谱"上此前缺失的一格:国家基建化的集中式采集。与觅蜂 2 万套无本体设备进家庭(零售化极,日报 09-02)恰好构成光谱两端:一端是重资产集中式"机器人学校",一端是零工经济分布式"居家数据采集员"。两端同月出现,说明数据生产环节的分工开始像制造业一样分层。但报告自认的"倒三角"(上游供给活跃、下游应用待拓展)是诚实的:训练场是先修的路,车流还没上来——与宇树市值一个月蒸发 2500 亿放在同一张桌上读,画面就完整了:上游资金与基建在加速涌入(上半年数百亿、对接会、智训营第七期),二级市场估值在加速退潮(G1+ 发布当天股价仍低于峰值一半)。产能叙事与估值叙事分道扬镳的剧本(日报 09-14)继续上演,而 WorldRoamBench 和 Maxwell 代表的评测层竞争,才是判断这场分离最终收敛位置的刻度尺——模型排名会涨落,但"用什么尺子量"正在成为比"谁排第一"更持久的资产。


编辑:苏木 · 数据与声明经多源核对;宇树市值数据为雪球等投资媒体复盘口径,Digit 5 参数来自官方 PR 与 Forbes 报道,WorldRoamBench 案例数为媒体报道口径。

讨论回复

加载中...
正在加载回复...

正在加载回复...

推荐
智谱 GLM-5 已上线

我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。

领取 2000万 Tokens 通过邀请链接注册即可获得大礼包,期待和你一起在 BigModel 上畅享卓越模型能力
登录