Picture for Fangxu Yu

Fangxu Yu

LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers

Add code
Aug 07, 2026
Viaarxiv icon

Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning

Add code
Aug 03, 2026
Viaarxiv icon

Weak-to-Strong On-Policy Distillation

Add code
Jul 28, 2026
Viaarxiv icon

TSRouter: Dynamic Modality-Model Selection for Time Series Reasoning

Add code
Jul 09, 2026
Viaarxiv icon

FlowBank: Query-Adaptive Agentic Workflows Optimization through Precompute-and-Reuse

Add code
Jun 09, 2026
Viaarxiv icon

TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models

Add code
Jan 26, 2026
Viaarxiv icon

ArrowGEV: Grounding Events in Video via Learning the Arrow of Time

Add code
Jan 10, 2026
Viaarxiv icon

ArcMemo: Abstract Reasoning Composition with Lifelong LLM Memory

Add code
Sep 04, 2025
Figure 1 for ArcMemo: Abstract Reasoning Composition with Lifelong LLM Memory
Figure 2 for ArcMemo: Abstract Reasoning Composition with Lifelong LLM Memory
Figure 3 for ArcMemo: Abstract Reasoning Composition with Lifelong LLM Memory
Figure 4 for ArcMemo: Abstract Reasoning Composition with Lifelong LLM Memory
Viaarxiv icon

PersuasiveToM: A Benchmark for Evaluating Machine Theory of Mind in Persuasive Dialogues

Add code
Feb 28, 2025
Viaarxiv icon

Flow of Reasoning: Efficient Training of LLM Policy with Divergent Thinking

Add code
Jun 09, 2024
Figure 1 for Flow of Reasoning: Efficient Training of LLM Policy with Divergent Thinking
Figure 2 for Flow of Reasoning: Efficient Training of LLM Policy with Divergent Thinking
Figure 3 for Flow of Reasoning: Efficient Training of LLM Policy with Divergent Thinking
Figure 4 for Flow of Reasoning: Efficient Training of LLM Policy with Divergent Thinking
Viaarxiv icon