Bridge-WA · ProgressVLA · TraceVLA · VP-VLA · SwiftVLA · OASIS | 选题碰撞风险与 2D-RPF/CAPE 差异化路线
这 6 篇已经把“VLA 外部引导/视觉提示/世界变化/进度/几何中间表示”的主要自然方向占掉了大半。当前 2D-RPF/CAPE 如果想发顶会,不能再停留在“画提示、估进度、预测哪里变、引入轨迹/几何”这几个泛化表述上。
| 论文 | 占据的 idea 空间 | 一句话边界 |
|---|---|---|
| Bridge-WA | world-change priorswhere/how changes | 已经占据“预测世界哪里变、怎么变并注入 policy”。 |
| ProgressVLA | progress guidancediffusion gradient | 已经占据“任务进度估计 + 推理时引导扩散动作”。 |
| TraceVLA | 2D visual tracehistory prompting | 已经占据“CoTracker 2D 历史轨迹画到图像上增强 VLA”。 |
| VP-VLA | visual prompt interfaceinstruction decomposition | 已经占据“System-2 分解指令 + SAM 画 crosshair/bbox + VLA 执行”。 |
| SwiftVLA | 4D distillationlightweight VLA | 已经占据“训练时学 4D 时空动态、推理时丢 4D”的效率路线。 |
| OASIS | SE(3) trajectoryaction-space alignment | 已经占据“用 SE(3) 末端轨迹把中间表示对齐动作空间”。 |
| 维度 | Bridge-WA | ProgressVLA | TraceVLA | VP-VLA | SwiftVLA | OASIS |
|---|---|---|---|---|---|---|
| 输入提示 | future tokens/change/flow priors | progress scalar | 原图+trace图 | 原图+visual prompt图 | 训练期2D+4D特征 | RGB+metric depth features |
| 是否预测未来 | 是,未来变化 teacher | 间接,world model 预测 future latent | 否,历史 trace | 否,当前阶段提示 | 训练期未来轨迹监督 | 预测未来 SE(3) 轨迹 |
| 是否推理时引导 | policy conditioning | classifier guidance 修正扩散采样 | 输入增强 | 输入接口增强 | 推理无 4D,知识内化 | 中间表示进入动作解码 |
| 是否依赖 3D | 主要视觉变化先验 | 视觉 latent | 2D RGB | 2D RGB | 4D 几何 teacher,但推理纯 RGB | metric depth + SE(3) |
| 对我们最相关 | where/how change | progress guidance | 2D trace | visual prompt + instruction structuring | 时空表征蒸馏 | 轨迹/动作空间对齐 |
这就是 2D-RPF/CAPE 还能站住的位置:不是给 VLA 更多输入,而是给 VLA 的候选输出一个结构化、对象中心、任务阶段相关的“验收器”。
| 论文 | Benchmark/平台 | 任务/评测重点 | 为什么选这些 |
|---|---|---|---|
| Bridge-WA | VLABench, RoboTwin2.0, LIBERO-Plus, Dobot 真机 | 复杂操作、Easy/Hard、OOD 变体、真实桌面任务 | 验证 world-change priors 是否提升“哪里/如何变化”的跨场景操作。 |
| ProgressVLA | CALVIN ABC→D, LIBERO, ARX AC-One 真机 | CALVIN 连续五任务;LIBERO Spatial/Object/Goal/Long;真实操作 | progress guidance 天然适合长程、多阶段和目标完成度评测。 |
| TraceVLA | SimplerEnv, WidowX-250 真机, LIBERO | 相机/光照/背景/干扰物变体;8 个 WidowX 任务;LIBERO 四套件 | 验证 2D 历史轨迹对空间-时序鲁棒性的贡献。 |
| VP-VLA | RoboCasa-GR1-Tabletop, SimplerEnv, 真实 OOD | 24 个厨房 tabletop 多阶段任务;4 个 SimplerEnv 任务;waste sorting / colored egg / egg carton placement | 直接验证视觉提示接口对 OOD 物体、颜色、位置指令跟随的帮助。 |
| SwiftVLA | RoboTwin2.0, LIBERO, 真实任务, Jetson Orin | 短/中/长程任务、LIBERO 四套件、真机和边缘效率 | 证明 4D 蒸馏能让轻量 VLA 保持时空能力且低延迟。 |
| OASIS | LIBERO, CALVIN ABC→D, 真机 OOD | LIBERO 四套件;CALVIN 五连任务;背景/视角/人为干扰 | 验证 SE(3) 中间表示对几何精确操作和 OOD 真实部署的价值。 |
| 论文 | 代表结果 | 解读 |
|---|---|---|
| Bridge-WA | VLABench Avg SR 52.8;LIBERO-Plus Avg 72.1;Dobot Hard 69.1% | world-change priors 对复杂和真机 hard split 有明显价值。 |
| ProgressVLA | CALVIN Full Avg.Len 3.73;LIBERO Full Avg 84.5 | progress guidance 对长程和扩散采样有稳定增益。 |
| TraceVLA | LIBERO Avg 74.8 vs OpenVLA 70.6;Long 54.1 vs 45.7;真机约 3.5× OpenVLA | 2D trace 对历史依赖和长程任务帮助更大。 |
| VP-VLA | RoboCasa Avg 53.8 vs QwenOFT 48.8;SimplerEnv 58.3;colored egg OOD color 75.0 vs 29.2 | visual prompt interface 对精确 grounding/OOD 指令跟随非常直接。 |
| SwiftVLA | LIBERO Avg 94.7;Jetson Orin 0.167s/1398MB/SR 0.76 | 效率路线强,不是我们当前主要竞争点,但说明时空知识可训练期蒸馏。 |
| OASIS | LIBERO 97.6;CALVIN 4.57/五连 83.3;真机 89.2;OOD 90.8 | 几何中间表示路线很强,但需要 metric depth/SE(3) 设定。 |
| 我们可能想说 | 会撞谁 | 为什么撞 | 避让方式 |
|---|---|---|---|
| 预测世界哪里会变、怎么变 | Bridge-WA | change map / motion-flow map 已是核心贡献 | 改成“候选动作是否导致正确关系进展”,不是预测全局变化先验。 |
| 用任务进度引导动作 | ProgressVLA | progress estimator + world model + classifier guidance 已覆盖 | 不要用单标量 progress;做对象-关系-阶段分解的 action suitability。 |
| 用 2D 点轨迹增强时空理解 | TraceVLA | CoTracker visual trace prompting 已覆盖 | 轨迹只能作为证据之一,不能作为主贡献。 |
| 把 instruction 结构化,再画目标框/点 | VP-VLA | System-2 planner + SAM3 + crosshair/bbox 已覆盖 | 结构化和视觉提示只做前端,主贡献放在 action verification。 |
| 训练时引入时空/4D 表征,推理时高效 | SwiftVLA | 4D distillation 已是完整论文 | 除非有强新模态/新蒸馏机制,否则不作为主线。 |
| 对齐图像轨迹/语言/末端轨迹 | OASIS + TraceVLA | OASIS 对齐 SE(3) 轨迹,TraceVLA 对齐 2D visual trace | 若坚持 2D,应明确“不预测/回归轨迹本身,而评估候选动作造成的关系变化”。 |
| 阶段 | 要交付 | 通过标准 |
|---|---|---|
| Week 1 | 在 LIBERO/SimplerEnv 上生成候选动作集和失败类型标注脚本 | 能稳定复现 baseline failure,并分出 wrong object/region/stage/no-progress。 |
| Week 2 | 实现 2D relation progress verifier | offline 能区分正确动作与 plausible-but-wrong 动作;不仅看分类准确率,还看候选排序。 |
| Week 3 | 接入 reranking/rejection 到现有 policy | 标准任务成功率不下降,counterfactual/OOD split 明显下降错误率。 |
| Week 4 | 对比 VP-VLA/TraceVLA/ProgressVLA 风格 baseline | 证明不是画框、不是历史 trace、不是单标量 progress 带来的收益。 |
| Week 5 | 消融 + failure case + 论文图 | 能讲清“关系进展验证”作为新能力维度成立。 |