Picture for Masashi Sugiyama

Masashi Sugiyama

Tokyo Institute of Technology

Recent advances in weakly supervised learning: New supervision paradigms, assumption relaxations, and practical solutions

Add code
Aug 07, 2026
Viaarxiv icon

Accelerating Discrete Diffusion Models with Parallel-In-Time Sampling

Add code
Jul 01, 2026
Viaarxiv icon

Selective Ensemble Based on Preference-Directed Multi-Objective Bandits

Add code
Jun 20, 2026
Viaarxiv icon

Do Coding Agents Deceive Us? Detecting and Preventing Cheating via Capped Evaluation with Randomized Tests

Add code
Jun 05, 2026
Viaarxiv icon

Accelerated Dynamic Importance Weighting with Versatile Divergence-Minimizing Estimators

Add code
May 25, 2026
Viaarxiv icon

Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX

Add code
May 20, 2026
Viaarxiv icon

Shaping Schema via Language Representation as the Next Frontier for LLM Intelligence Expanding

Add code
May 10, 2026
Viaarxiv icon

Decomposing the Basic Abilities of Large Language Models: Mitigating Cross-Task Interference in Multi-Task Instruct-Tuning

Add code
May 07, 2026
Viaarxiv icon

Data-dependent Exploration for Online Reinforcement Learning from Human Feedback

Add code
May 06, 2026
Viaarxiv icon

Riemannian Langevin Dynamics: Strong Convergence of Geometric Euler-Maruyama Scheme

Add code
Mar 04, 2026
Viaarxiv icon