Picture for Jungang Li

Jungang Li

Debias in Text, Believe Your Eyes: Text-Anchored Cross-Modal Transfer for Visual Counter-Commonsense Reasoning

Add code
Aug 07, 2026
Viaarxiv icon

Vidu S1: A Real-Time Interactive Video Generation Model

Add code
Jul 03, 2026
Viaarxiv icon

Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs

Add code
May 31, 2026
Viaarxiv icon

SpikingMoE: SDPrompt-Guided Dynamic Expert Fusion in Spiking Neural Networks

Add code
May 22, 2026
Viaarxiv icon

Seizure-Semiology-Suite (S3): A Clinically Multimodal Dataset, Benchmark, and Models for Seizure Semiology Understanding

Add code
May 21, 2026
Viaarxiv icon

Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization

Add code
Apr 13, 2026
Viaarxiv icon

Unveiling Language Routing Isolation in Multilingual MoE Models for Interpretable Subnetwork Adaptation

Add code
Apr 04, 2026
Viaarxiv icon

AndroTMem: From Interaction Trajectories to Anchored Memory in Long-Horizon GUI Agents

Add code
Mar 19, 2026
Viaarxiv icon

Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models

Add code
Mar 18, 2026
Viaarxiv icon

Unlocking Multimodal Document Intelligence: From Current Triumphs to Future Frontiers of Visual Document Retrieval

Add code
Feb 23, 2026
Viaarxiv icon