Picture for Wentao Ye

Wentao Ye

Reasoning Error from Known Fact: Step-Level Self-Consistency Group Relative Policy Optimization for LLM

Add code
Jul 21, 2026
Viaarxiv icon

Semantically Similar, Logically Distinct: Diagnosing the Semantic-Answerability Gap in Table RAG

Add code
Jul 20, 2026
Viaarxiv icon

Purified OPSD: On-Policy Self-Distillation Without Losing How to Think

Add code
Jul 02, 2026
Viaarxiv icon

Eliciting Complex Spatial Reasoning in MLLMs through Wide-Baseline Matching

Add code
Jun 02, 2026
Viaarxiv icon

FLaG: Fine-Grained Latent Grouping for Hallucination Detection

Add code
May 29, 2026
Viaarxiv icon

From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment

Add code
May 20, 2026
Viaarxiv icon

LLaDA2.1: Speeding Up Text Diffusion via Token Editing

Add code
Feb 09, 2026
Viaarxiv icon

Supervised Fine-Tuning Needs to Unlock the Potential of Token Priority

Add code
Feb 01, 2026
Viaarxiv icon

Training-Trajectory-Aware Token Selection

Add code
Jan 15, 2026
Viaarxiv icon

TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning

Add code
Dec 23, 2025
Figure 1 for TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning
Figure 2 for TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning
Figure 3 for TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning
Figure 4 for TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning
Viaarxiv icon