Picture for Fangming Feng

Fangming Feng

VoxZip: Semantic-Anchored Temporal KV Cache Compression for Long-Context Audio Inference

Add code
Aug 09, 2026
Viaarxiv icon

Character Beyond Speech: Leveraging Role-Playing Evaluation in Audio Large Language Models via Reinforcement Learning

Add code
Apr 15, 2026
Viaarxiv icon

Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision

Add code
Apr 30, 2025
Viaarxiv icon