Picture for Yuan Ge

Yuan Ge

FlowCTS: On-policy Continuous Trajectory Supervision of Flow Models

Add code
Jul 27, 2026
Viaarxiv icon

ToFu: A White-Box, Token-Efficient Agent Harness for Researchers

Add code
Jul 13, 2026
Viaarxiv icon

DirectAudioEdit: Inversion-Free Text-Guided Audio Editing via Diffusion Prediction Contrast

Add code
Jun 05, 2026
Viaarxiv icon

On the Emotion Understanding of Synthesized Speech

Add code
Mar 17, 2026
Viaarxiv icon

StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control

Add code
Mar 08, 2026
Viaarxiv icon

When Scaling Fails: Mitigating Audio Perception Decay of LALMs via Multi-Step Perception-Aware Reasoning

Add code
Feb 28, 2026
Viaarxiv icon

VisualActBench: Can VLMs See and Act like a Human?

Add code
Dec 10, 2025
Viaarxiv icon

SUBQRAG: sub-question driven dynamic graph rag

Add code
Oct 09, 2025
Viaarxiv icon

FLEXI: Benchmarking Full-duplex Human-LLM Speech Interaction

Add code
Sep 26, 2025
Viaarxiv icon

SageLM: A Multi-aspect and Explainable Large Language Model for Speech Judgement

Add code
Aug 28, 2025
Viaarxiv icon