Picture for Zhaopeng Tu

Zhaopeng Tu

Don't Wait to Reply: Towards Responsive yet Thoughtful Dialogue through Proactive Thinking

Add code
Jul 03, 2026
Viaarxiv icon

Homer: Understanding Long-form Videos with Hierarchical Memory and Agentic Reasoning

Add code
Jul 01, 2026
Viaarxiv icon

AdaMem: Learning What to Remember for Personalized Long-Horizon LLM Agents

Add code
Jun 19, 2026
Viaarxiv icon

Think Fast and Slow: Step-Level Cognitive Depth Adaptation for LLM Agents

Add code
Feb 13, 2026
Viaarxiv icon

The Script is All You Need: An Agentic Framework for Long-Horizon Dialogue-to-Cinematic Video Generation

Add code
Jan 27, 2026
Viaarxiv icon

Too Good to be Bad: On the Failure of LLMs to Role-Play Villains

Add code
Nov 12, 2025
Viaarxiv icon

BatonVoice: An Operationalist Framework for Enhancing Controllable Speech Synthesis with Linguistic Intelligence from LLMs

Add code
Sep 30, 2025
Viaarxiv icon

CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models

Add code
Sep 11, 2025
Figure 1 for CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
Figure 2 for CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
Figure 3 for CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
Figure 4 for CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
Viaarxiv icon

RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents

Add code
Jul 30, 2025
Figure 1 for RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
Figure 2 for RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
Figure 3 for RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
Figure 4 for RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
Viaarxiv icon

CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards

Add code
Jul 23, 2025
Figure 1 for CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards
Figure 2 for CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards
Figure 3 for CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards
Figure 4 for CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards
Viaarxiv icon