Picture for Guoyin Wang

Guoyin Wang

Adaptive $k$ Nearest Neighbors Classifier via Granular Ball Computing

Add code
Aug 13, 2026
Viaarxiv icon

ARMOR: Stabilizing On-Policy LLM RL with Off-Policy Anchor Samples

Add code
Jul 11, 2026
Viaarxiv icon

Experience Augmented Policy Optimization for LLM Reasoning

Add code
Jun 29, 2026
Viaarxiv icon

One-Way Policy Optimization for Self-Evolving LLMs

Add code
May 21, 2026
Viaarxiv icon

Clipping Bottleneck: Stabilizing RLVR via Stochastic Recovery of Near-Boundary Signals

Add code
May 21, 2026
Viaarxiv icon

GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforcement Learning

Add code
Apr 03, 2026
Viaarxiv icon

Square Superpixel Generation and Representation Learning via Granular Ball Computing

Add code
Mar 31, 2026
Viaarxiv icon

Efficient and Scalable Granular-ball Graph Coarsening Method for Large-scale Graph Node Classification

Add code
Mar 31, 2026
Viaarxiv icon

Bridging Perception and Reasoning: Token Reweighting for RLVR in Multimodal LLMs

Add code
Mar 26, 2026
Viaarxiv icon

On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation

Add code
Mar 23, 2026
Viaarxiv icon