Picture for Bo Xue

Bo Xue

LitTraceQA: A Benchmark for Multi-Stage Grounding and Verification in Scientific Question Answering

Add code
Aug 07, 2026
Viaarxiv icon

Cost-Aware Multi-Objective Bandits: Theory and Application to Budgeted LLM Configuration Evaluation

Add code
Aug 05, 2026
Viaarxiv icon

Efficient Online Lexicographic Generalized Low-Rank Matrix Bandits

Add code
Aug 05, 2026
Viaarxiv icon

RADAR: Reasoning as Discrimination with Aligned Representations for LLM-based Knowledge Graph Reasoning

Add code
Feb 25, 2026
Viaarxiv icon

Flow of Spans: Generalizing Language Models to Dynamic Span-Vocabulary via GFlowNets

Add code
Feb 11, 2026
Viaarxiv icon

Improved Approximate Regret for Decentralized Online Continuous Submodular Maximization via Reductions

Add code
Feb 10, 2026
Viaarxiv icon

Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives

Add code
Feb 03, 2026
Viaarxiv icon

Consistency Is Not Always Correct: Towards Understanding the Role of Exploration in Post-Training Reasoning

Add code
Nov 10, 2025
Viaarxiv icon

Beyond the Lower Bound: Bridging Regret Minimization and Best Arm Identification in Lexicographic Bandits

Add code
Nov 08, 2025
Viaarxiv icon

Parametric Pareto Set Learning for Expensive Multi-Objective Optimization

Add code
Nov 08, 2025
Figure 1 for Parametric Pareto Set Learning for Expensive Multi-Objective Optimization
Figure 2 for Parametric Pareto Set Learning for Expensive Multi-Objective Optimization
Figure 3 for Parametric Pareto Set Learning for Expensive Multi-Objective Optimization
Figure 4 for Parametric Pareto Set Learning for Expensive Multi-Objective Optimization
Viaarxiv icon