Picture for Dawei Yin

Dawei Yin

Janus: An Algorithm-Evaluator Co-Evolution Framework for LLM-Driven Discovery under Expensive Evaluation Budgets

Add code
Aug 08, 2026
Viaarxiv icon

DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations

Add code
Jul 22, 2026
Viaarxiv icon

Beyond Static Evaluation: Co-Evolutionary Mechanisms for LLM-Driven Strategy Evolution in Adversarial Games

Add code
Jun 09, 2026
Viaarxiv icon

DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning

Add code
Jun 05, 2026
Viaarxiv icon

When Tools Fail: Benchmarking Dynamic Replanning and Anomaly Recovery in LLM Agents

Add code
Jun 04, 2026
Viaarxiv icon

Joint Agent Memory and Exploration Learning via Novelty Signals

Add code
Jun 01, 2026
Viaarxiv icon

Large Language Model-Powered Query-Driven Event Timeline Summarization in Industrial Search

Add code
May 26, 2026
Viaarxiv icon

EndPrompt: Efficient Long-Context Extension via Terminal Anchoring

Add code
May 14, 2026
Viaarxiv icon

RAG-Enhanced Large Language Models for Dynamic Content Expiration Prediction in Web Search

Add code
May 13, 2026
Viaarxiv icon

Rollout Pass-Rate Control: Steering Binary-Reward RL Toward Its Most Informative Regime

Add code
May 06, 2026
Viaarxiv icon