Picture for Junfeng Li

Junfeng Li

SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models

Add code
Aug 09, 2026
Viaarxiv icon

Robust-WAM: Bridging Generative Pretraining and Semantic Foresight in World-Action Models

Add code
Aug 07, 2026
Viaarxiv icon

Is Forward Prediction Enough? Physical State Grounding for JEPA World Models

Add code
Aug 07, 2026
Viaarxiv icon

DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation

Add code
Aug 06, 2026
Viaarxiv icon

GD$^2$PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization

Add code
Jun 15, 2026
Viaarxiv icon

Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening

Add code
Apr 16, 2026
Viaarxiv icon

VLA-OPD: Bridging Offline SFT and Online RL for Vision-Language-Action Models via On-Policy Distillation

Add code
Mar 27, 2026
Viaarxiv icon

DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models

Add code
Mar 23, 2026
Viaarxiv icon

FlowVLA: Thinking in Motion with a Visual Chain of Thought

Add code
Aug 25, 2025
Viaarxiv icon

FinTMMBench: Benchmarking Temporal-Aware Multi-Modal RAG in Finance

Add code
Mar 07, 2025
Figure 1 for FinTMMBench: Benchmarking Temporal-Aware Multi-Modal RAG in Finance
Figure 2 for FinTMMBench: Benchmarking Temporal-Aware Multi-Modal RAG in Finance
Figure 3 for FinTMMBench: Benchmarking Temporal-Aware Multi-Modal RAG in Finance
Figure 4 for FinTMMBench: Benchmarking Temporal-Aware Multi-Modal RAG in Finance
Viaarxiv icon