Picture for Paul Pacaud

Paul Pacaud

PointACT: Vision-Language-Action Models with Multi-Scale Point-Action Interaction

Add code
May 20, 2026
Viaarxiv icon

Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation

Add code
Jun 12, 2025
Figure 1 for Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
Figure 2 for Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
Figure 3 for Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
Figure 4 for Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
Viaarxiv icon