Picture for Yiyan Qi

Yiyan Qi

$\varepsilon$-MemEvo: Adaptive Cross-Task Memory Transfer for LLM Program Evolution

Add code
Aug 12, 2026
Viaarxiv icon

DASH-OPD: Discrepancy-Aware Switching with Hysteresis for On-Policy Distillation

Add code
Jul 31, 2026
Viaarxiv icon

Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility

Add code
Jul 29, 2026
Viaarxiv icon

Demystifying Reinforcement Learning for Long-Horizon Tool-Using Agents: A Comprehensive Recipe

Add code
Mar 23, 2026
Viaarxiv icon

VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning

Add code
Mar 03, 2026
Viaarxiv icon

ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting

Add code
Feb 23, 2026
Viaarxiv icon

Janus-Q: End-to-End Event-Driven Trading via Hierarchical-Gated Reward Modeling

Add code
Feb 23, 2026
Viaarxiv icon

Learning Discriminative and Generalizable Anomaly Detector for Dynamic Graph with Limited Supervision

Add code
Feb 23, 2026
Viaarxiv icon

QuantBench: Benchmarking AI Methods for Quantitative Investment

Add code
Apr 24, 2025
Figure 1 for QuantBench: Benchmarking AI Methods for Quantitative Investment
Figure 2 for QuantBench: Benchmarking AI Methods for Quantitative Investment
Figure 3 for QuantBench: Benchmarking AI Methods for Quantitative Investment
Figure 4 for QuantBench: Benchmarking AI Methods for Quantitative Investment
Viaarxiv icon

Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making

Add code
Nov 15, 2024
Figure 1 for Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making
Figure 2 for Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making
Figure 3 for Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making
Figure 4 for Guided Learning: Lubricating End-to-End Modeling for Multi-stage Decision-making
Viaarxiv icon