Picture for Ruina Hu

Ruina Hu

CLBench-V: Evaluating Multimodal Context Learning from Grounding to Knowledge Acquisition

Add code
Jul 28, 2026
Viaarxiv icon

RoboSemanticBench: Diagnosing Semantic Grounding in Action Prediction for VLA Models

Add code
Jun 01, 2026
Viaarxiv icon

Attend to Evidence: Evidence-Anchored Spatial Attention Supervision for Multimodal RLVR

Add code
May 29, 2026
Viaarxiv icon