Picture for Juncheng Wang

Juncheng Wang

Beyond Time Shifts: Adapting Omni-LLM as a Reference-Free Evaluator for Generative Audio-Visual Models

Add code
Jul 10, 2026
Viaarxiv icon

Progression as Latent Drift: Generative Forecasting of Slow-Evolving Pathologies

Add code
Jul 09, 2026
Viaarxiv icon

DenseControl: Instance-Level Controllable Synthesis of Dense Crowd Image

Add code
Jun 14, 2026
Viaarxiv icon

NEWTON: Agentic Planning for Physically Grounded Video Generation

Add code
May 19, 2026
Viaarxiv icon

AD-CARE: A Guideline-grounded, Modality-agnostic LLM Agent for Real-world Alzheimer's Disease Diagnosis with Multi-cohort Assessment, Fairness Analysis, and Reader Study

Add code
Mar 26, 2026
Viaarxiv icon

Guided by the Plan: Enhancing Faithful Autoregressive Text-to-Audio Generation with Guided Decoding

Add code
Jan 18, 2026
Viaarxiv icon

Think Before You Move: Latent Motion Reasoning for Text-to-Motion Generation

Add code
Dec 30, 2025
Viaarxiv icon

An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges

Add code
Dec 19, 2025
Viaarxiv icon

Exploring Scale Shift in Crowd Localization under the Context of Domain Generalization

Add code
Oct 22, 2025
Viaarxiv icon

Language Model Based Text-to-Audio Generation: Anti-Causally Aligned Collaborative Residual Transformers

Add code
Oct 06, 2025
Viaarxiv icon