Picture for Boxi Cao

Boxi Cao

DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations

Add code
Jul 22, 2026
Viaarxiv icon

OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models

Add code
Jul 03, 2026
Viaarxiv icon

PraMem: Practice-derived Experiential Memory for Long-horizon Behavior Prediction

Add code
Jul 03, 2026
Viaarxiv icon

ReasoningLens: Hierarchical Visualization and Diagnostic Auditing for Large Reasoning Models

Add code
Jun 22, 2026
Viaarxiv icon

The Meta-Agent Challenge: Are Current Agents Capable of Autonomous Agent Development?

Add code
Jun 03, 2026
Viaarxiv icon

Combinatorial Synthesis: Scaling Code RLVR via Atomic Decomposition and Recombination

Add code
May 29, 2026
Viaarxiv icon

LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents

Add code
May 28, 2026
Viaarxiv icon

MetaphorVU: Towards Metaphorical Video Understanding

Add code
May 25, 2026
Viaarxiv icon

Learning from Failures: Correction-Oriented Policy Optimization with Verifiable Rewards

Add code
May 14, 2026
Viaarxiv icon

All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG

Add code
Apr 22, 2026
Viaarxiv icon