Picture for Zhibang Yang

Zhibang Yang

LoongReflect: Boosting Long-Horizon Reflection in Search Agents via Global Perspective Distillation

Add code
Aug 12, 2026
Viaarxiv icon

Beyond Fail-to-Pass: Iterative Hardening of Co-Generated Bug Reproduction Tests and Fixes

Add code
Jul 22, 2026
Viaarxiv icon

ToolAtlas: Learning Once, Reusing Everywhere with Tool-Side Memory

Add code
Jul 13, 2026
Viaarxiv icon

The Weakest Link Tells It All: Outcome-Supervised Process Reward Modeling via Learnable Credit Assignment

Add code
Jun 26, 2026
Viaarxiv icon

ScaffoldAgent: Utility-Guided Dynamic Outline Optimization for Open-Ended Deep Research

Add code
Jun 18, 2026
Viaarxiv icon

GraphWalker: Graph-Guided In-Context Learning for Clinical Reasoning on Electronic Health Records

Add code
Apr 08, 2026
Viaarxiv icon

What Do Agents Learn from Trajectory-SFT: Semantics or Interfaces?

Add code
Feb 02, 2026
Viaarxiv icon

StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management

Add code
Jan 09, 2026
Viaarxiv icon

Bridging Global Intent with Local Details: A Hierarchical Representation Approach for Semantic Validation in Text-to-SQL

Add code
Dec 28, 2025
Viaarxiv icon

LoRA Dropout as a Sparsity Regularizer for Overfitting Control

Add code
Apr 15, 2024
Figure 1 for LoRA Dropout as a Sparsity Regularizer for Overfitting Control
Figure 2 for LoRA Dropout as a Sparsity Regularizer for Overfitting Control
Figure 3 for LoRA Dropout as a Sparsity Regularizer for Overfitting Control
Figure 4 for LoRA Dropout as a Sparsity Regularizer for Overfitting Control
Viaarxiv icon