Picture for Yuhang Jiang

Yuhang Jiang

Chaos Is a LADDER: Domain Generalization Beyond Invariance via Reweighting

Add code
Jul 29, 2026
Viaarxiv icon

GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation

Add code
Jul 04, 2026
Viaarxiv icon

The Scissors Effect: When Resize-Based Input Diversity Helps or Hurts Transfer Attacks

Add code
Jun 21, 2026
Viaarxiv icon

TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning

Add code
Jun 09, 2026
Viaarxiv icon

Task Structure Reverses Layerwise State Encoding in Sequence Models

Add code
May 30, 2026
Viaarxiv icon

Detection vs. Execution: Single-Bucket Probes Miss Half the Mamba-2 State Sink

Add code
May 30, 2026
Viaarxiv icon

PInVerify: An Offline Embodied Benchmark for Active Instance Verification

Add code
May 28, 2026
Viaarxiv icon

Listwise Policy Optimization: Group-based RLVR as Target-Projection on the LLM Response Simplex

Add code
May 07, 2026
Viaarxiv icon

Closing Reasoning Gaps in Clinical Agents with Differential Reasoning Learning

Add code
Feb 10, 2026
Viaarxiv icon

Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models

Add code
Feb 02, 2026
Viaarxiv icon