Picture for Xing Zheng

Xing Zheng

HopRefusalBench: Diagnosing Refusal Failures in Search-Augmented Agents for Multi-Hop Reasoning

Add code
Aug 02, 2026
Viaarxiv icon

EviSD: Evidence-Conditioned Self-Distillation for Search-Augmented Agents

Add code
Aug 02, 2026
Viaarxiv icon

OPRD: On-Policy Representation Distillation

Add code
Jun 04, 2026
Viaarxiv icon

GeoMin: Data-Efficient Semi-Supervised RLVR via Geometric Distribution Modeling

Add code
Jun 03, 2026
Viaarxiv icon

Smart Picks in the Dark: Towards Efficient RLVR for Reasoning via Tracing Metacognitive Pivots

Add code
Jun 03, 2026
Viaarxiv icon

Can LLMs Learn to Reason Robustly under Noisy Supervision?

Add code
Apr 05, 2026
Viaarxiv icon

TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning

Add code
Dec 15, 2025
Figure 1 for TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
Figure 2 for TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
Figure 3 for TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
Figure 4 for TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning
Viaarxiv icon

KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering

Add code
Dec 10, 2025
Viaarxiv icon

SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity

Add code
Dec 30, 2024
Figure 1 for SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity
Figure 2 for SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity
Figure 3 for SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity
Figure 4 for SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity
Viaarxiv icon

DiffUTE: Universal Text Editing Diffusion Model

Add code
May 19, 2023
Figure 1 for DiffUTE: Universal Text Editing Diffusion Model
Figure 2 for DiffUTE: Universal Text Editing Diffusion Model
Figure 3 for DiffUTE: Universal Text Editing Diffusion Model
Figure 4 for DiffUTE: Universal Text Editing Diffusion Model
Viaarxiv icon