Picture for Baolong Bi

Baolong Bi

AISPA: User-Centric System Prompt Auditing for Large Language Model Applications

Add code
Jul 30, 2026
Viaarxiv icon

Audio-Zero: Label-Free Self-Evolution for Fine-Grained Audio Reasoning

Add code
Jul 22, 2026
Viaarxiv icon

LP-SFT: Local-Preserving Supervised Fine-Tuning via Multimodal Entropy Structure

Add code
Jul 06, 2026
Viaarxiv icon

SAW: Stage-Aware Dynamic Weighting for Multi-Objective Reinforcement Learning in Large Language Models

Add code
Jun 05, 2026
Viaarxiv icon

When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillation

Add code
Jun 02, 2026
Viaarxiv icon

Prism-$Δ$: Differential Subspace Steering for Prompt Highlighting in Large Language Models

Add code
Mar 11, 2026
Viaarxiv icon

FactGuard: Agentic Video Misinformation Detection via Reinforcement Learning

Add code
Feb 26, 2026
Viaarxiv icon

PromptCD: Test-Time Behavior Enhancement via Polarity-Prompt Contrastive Decoding

Add code
Feb 24, 2026
Viaarxiv icon

AuTAgent: A Reinforcement Learning Framework for Tool-Augmented Audio Reasoning

Add code
Feb 14, 2026
Viaarxiv icon

HE-SNR: Uncovering Latent Logic via Entropy for Guiding Mid-Training on SWE-BENCH

Add code
Jan 28, 2026
Viaarxiv icon