Picture for Jinyang Zhang

Jinyang Zhang

Search2Skill: Skill Distillation Beyond Knowledge Boundaries Via Rubric-Based Reinforcement Learning

Add code
Aug 05, 2026
Viaarxiv icon

BridgeAlign: Bridging Preference Alignment for Humanities and Social Sciences

Add code
Jul 29, 2026
Viaarxiv icon

HSS-Synth: Humanities and Social Sciences Data Synthesis for LLMs

Add code
Jul 29, 2026
Viaarxiv icon

EvoRubrics: Dynamic Rubrics as Rewards via Adversarial Co-Evolution for LLM Reinforcement Learning

Add code
Jun 22, 2026
Viaarxiv icon

The Tell-Tale Norm: $\ell_2$ Magnitude as a Signal for Reasoning Dynamics in Large Language Models

Add code
Jun 04, 2026
Viaarxiv icon

IConFace: Identity-Structure Asymmetric Conditioning for Unified Reference-Aware Face Restoration

Add code
May 04, 2026
Viaarxiv icon

The Second Challenge on Real-World Face Restoration at NTIRE 2026: Methods and Results

Add code
Apr 12, 2026
Viaarxiv icon

GraphWalker: Graph-Guided In-Context Learning for Clinical Reasoning on Electronic Health Records

Add code
Apr 08, 2026
Viaarxiv icon

Astra: Toward General-Purpose Mobile Robots via Hierarchical Multimodal Learning

Add code
Jun 06, 2025
Viaarxiv icon

3DS: Decomposed Difficulty Data Selection's Case Study on LLM Medical Domain Adaptation

Add code
Oct 13, 2024
Figure 1 for 3DS: Decomposed Difficulty Data Selection's Case Study on LLM Medical Domain Adaptation
Figure 2 for 3DS: Decomposed Difficulty Data Selection's Case Study on LLM Medical Domain Adaptation
Figure 3 for 3DS: Decomposed Difficulty Data Selection's Case Study on LLM Medical Domain Adaptation
Figure 4 for 3DS: Decomposed Difficulty Data Selection's Case Study on LLM Medical Domain Adaptation
Viaarxiv icon