Picture for Lifan Guo

Lifan Guo

Qwen DianJin Team, Alibaba Cloud Computing

Dual-Loop Self-Evolution via Verifiable Emotion Feedback for Multi-Turn Empathetic Dialogue

Add code
Aug 11, 2026
Viaarxiv icon

REDAgentBench: Executable Red Teaming and Faithful Measurement of LLM Agent Systems

Add code
Aug 11, 2026
Viaarxiv icon

FinEvo-Bench: A Longitudinal Benchmark for Self-Evolving Agents in Professional Financial Workflows

Add code
Aug 06, 2026
Viaarxiv icon

FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents

Add code
Aug 04, 2026
Viaarxiv icon

FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables

Add code
Aug 04, 2026
Viaarxiv icon

FinGuard: Detecting Financial Regulatory Non-Compliance in LLM Interactions

Add code
May 28, 2026
Viaarxiv icon

ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations

Add code
May 27, 2026
Viaarxiv icon

Modeling Multiple Support Strategies within a Single Turn for Emotional Support Conversations

Add code
Apr 20, 2026
Viaarxiv icon

FinMCP-Bench: Benchmarking LLM Agents for Real-World Financial Tool Use under the Model Context Protocol

Add code
Mar 26, 2026
Viaarxiv icon

Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models

Add code
Aug 21, 2025
Viaarxiv icon