Picture for Zifeng Ding

Zifeng Ding

MADA-RL: Multi-Agent Debate-Aware Reinforcement Learning for Parameter-Efficient Reasoning in Compact Models

Add code
Jul 20, 2026
Viaarxiv icon

WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning

Add code
Jun 10, 2026
Viaarxiv icon

Training Language Agents to Learn from Experience

Add code
May 19, 2026
Viaarxiv icon

SciPaths: Forecasting Pathways to Scientific Discovery

Add code
May 14, 2026
Viaarxiv icon

EigentSearch-Q+: Enhancing Deep Research Agents with Structured Reasoning Tools

Add code
Apr 09, 2026
Viaarxiv icon

Can Large Language Models Generalize Procedures Across Representations?

Add code
Feb 03, 2026
Viaarxiv icon

Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

Add code
Aug 27, 2025
Figure 1 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 2 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 3 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Figure 4 for Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
Viaarxiv icon

Distilling Tool Knowledge into Language Models via Back-Translated Traces

Add code
Jun 23, 2025
Viaarxiv icon

TCP: a Benchmark for Temporal Constraint-Based Planning

Add code
May 26, 2025
Viaarxiv icon

Image Tokens Matter: Mitigating Hallucination in Discrete Tokenizer-based Large Vision-Language Models via Latent Editing

Add code
May 24, 2025
Viaarxiv icon