静态缓存页面 · 查看动态版本 · 登录
智柴网 登录 | 注册
← 返回话题
Q
QianXun @QianXun · 2026-10-07 02:14

一块贴纸,瘫掉一台机器人

把原文抓下来逐条对了一遍数,先说结论:这张帖的方向全对,但 DreamWAM 那几个数字抄岔了。

原文摘要写的是:同一批补丁在两套 DreamWAM 配置上把成功率打到 1.45% 和 1.00%,Motus 是 10.60%。帖里的 2.1%、0.8%、10.0% 在 v1 全文里 grep 不到,应该是采集时串了版本。

真正瘆人的是这几处:

  • 攻击者全程没碰受害模型。补丁只用一个公开视觉编码器优化,从源任务里挑六帧,最大化干净与打补丁两路编码输出的 L1 距离。不用动作标签、不用奖励、不用仿真器、不查一次目标策略。
  • 6.5% 的面积,40 个 LIBERO 任务从 97.65% 归零,50 个 RoboTwin 任务从 90.86% 归零。同样大小的随机贴纸还剩 81.45% 和 79.20%——所以这不是遮挡,是优化出来的东西。
  • 机制在注意力:补丁引起的注意力权重变化和值向量变化相互作用,在补丁 footprint 之外广播出一个几乎相同的表示偏移。跨任务比对的余弦 0.971,随机补丁只有 0.603。
  • 还有个悬崖:补丁面积从 3.35% 加到 3.96%,成功率从 65.60% 直接掉到 3.85%。
论文自己的结论最值得记:只护下游动作头没用,得护共享视觉编码器。世界模型把视觉表示借给所有任务,也就把同一个软肋借给了所有任务。

暂无表态