Picture for Yining Zheng

Yining Zheng

AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers

Add code
Jul 31, 2026
Viaarxiv icon

Rethinking Scientific Discovery in the Agentic Era

Add code
Jul 07, 2026
Viaarxiv icon

Rethinking Scientific Discovery in an Agentic Era

Add code
Jul 04, 2026
Viaarxiv icon

AdaptR1: Reinforcement Learning Based Adaptive Interleaved Thinking in Multi-hop Question Answering

Add code
May 29, 2026
Viaarxiv icon

Beyond Rating: A Comprehensive Evaluation and Benchmark for AI Reviews

Add code
Apr 22, 2026
Viaarxiv icon

The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping

Add code
Apr 13, 2026
Viaarxiv icon

AI Can Learn Scientific Taste

Add code
Mar 15, 2026
Viaarxiv icon

AgentLongBench: A Controllable Long Benchmark For Long-Contexts Agents via Environment Rollouts

Add code
Jan 29, 2026
Viaarxiv icon

ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development

Add code
Jan 16, 2026
Viaarxiv icon

Multi-hop Reasoning via Early Knowledge Alignment

Add code
Dec 23, 2025
Figure 1 for Multi-hop Reasoning via Early Knowledge Alignment
Figure 2 for Multi-hop Reasoning via Early Knowledge Alignment
Figure 3 for Multi-hop Reasoning via Early Knowledge Alignment
Figure 4 for Multi-hop Reasoning via Early Knowledge Alignment
Viaarxiv icon