Picture for Yongshi Ye

Yongshi Ye

Search2Skill: Skill Distillation Beyond Knowledge Boundaries Via Rubric-Based Reinforcement Learning

Add code
Aug 05, 2026
Viaarxiv icon

PAMT: Process-Aligned Reinforcement Learning for Multi-Domain Machine Translation

Add code
Aug 04, 2026
Viaarxiv icon

Don't Peek at the Answer: Outcome-Masked Group Relative Policy Optimization for Label-Free RLVR

Add code
Aug 04, 2026
Viaarxiv icon

Translation with Thought: Difficulty-Adaptive Reasoning via Reinforcement Learning for Multi-Domain Machine Translation

Add code
Jul 31, 2026
Viaarxiv icon

UMEM: Unified Memory Extraction and Management Framework for Generalizable Memory

Add code
Feb 11, 2026
Viaarxiv icon

How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation

Add code
May 26, 2025
Viaarxiv icon