Picture for Yiming Wang

Yiming Wang

FlowDance: Music-Driven Dance Video Generation with Parallel Pose and RGB Streams

Add code
Aug 16, 2026
Viaarxiv icon

SVGEval: A Vision-Grounded Framework for Perceptual-Quality Benchmarking and Evaluation in Text-to-SVG Generation

Add code
Aug 03, 2026
Viaarxiv icon

Evaluating Regional Bias in LLMs From Abstract Stereotype to Concrete Social Decision-Making

Add code
Jul 29, 2026
Viaarxiv icon

Disentangling Acoustic Cues in Alzheimer's Pathology and Perception: The Roles of Language and Gender

Add code
Jul 27, 2026
Viaarxiv icon

On the Systematic Challenges of Culturally Loaded Machine Translation: Dream of the Red Chamber as the Cultural Lens

Add code
Jul 22, 2026
Viaarxiv icon

QwenPaw-Data: Bridging Facts, Methodology, and Execution for Autonomous Enterprise Data Analytics

Add code
Jul 14, 2026
Viaarxiv icon

Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving

Add code
Jul 02, 2026
Viaarxiv icon

Personalizing MLLMs via Reinforced Multimodal Reference Game

Add code
Jun 27, 2026
Viaarxiv icon

LA4VLA: Learning to Act without Seeing via Language-Action Pretraining

Add code
Jun 25, 2026
Viaarxiv icon

LLM can Read Spectrogram: Encoder-free Speech-Language Modeling

Add code
Jun 08, 2026
Viaarxiv icon