Picture for Yuhui Chen

Yuhui Chen

Multi-Agent Forensic Reasoning for Generalizable Deepfake Video Detection

Add code
Aug 07, 2026
Viaarxiv icon

OvisOCR2 Technical Report

Add code
Jul 15, 2026
Viaarxiv icon

Posterior Optimization with Clipped Objective for Bridging Efficiency and Stability in Generative Policy Learning

Add code
Apr 02, 2026
Viaarxiv icon

WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL

Add code
Feb 15, 2026
Viaarxiv icon

Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL

Add code
Feb 13, 2026
Viaarxiv icon

Towards Long-Lived Robots: Continual Learning VLA Models via Reinforcement Fine-Tuning

Add code
Feb 11, 2026
Viaarxiv icon

Survey of Vision-Language-Action Models for Embodied Manipulation

Add code
Aug 21, 2025
Viaarxiv icon

LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization

Add code
Jun 11, 2025
Figure 1 for LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization
Figure 2 for LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization
Figure 3 for LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization
Figure 4 for LPO: Towards Accurate GUI Agent Interaction via Location Preference Optimization
Viaarxiv icon

TeViR: Text-to-Video Reward with Diffusion Models for Efficient Reinforcement Learning

Add code
May 26, 2025
Viaarxiv icon

ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy

Add code
Feb 08, 2025
Figure 1 for ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
Figure 2 for ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
Figure 3 for ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
Figure 4 for ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy
Viaarxiv icon