Picture for Junpei Komiyama

Junpei Komiyama

Mohamed bin Zayed University of Artificial Intelligence, RIKEN AIP

SGHA: Evidence-Grounded Research Problem Discovery with Local Language Models

Add code
Aug 18, 2026
Viaarxiv icon

Privileged Solutions or Context-Induced Teacher Behavior? Dissecting On-Policy Self-Distillation

Add code
Aug 10, 2026
Viaarxiv icon

Learning Optimal Dynamic Matching via Graph Neural Networks

Add code
Jul 31, 2026
Viaarxiv icon

Fixed-Confidence Best-Arm Identification for Causal Mediation Analysis

Add code
Jul 05, 2026
Viaarxiv icon

Finite-Time Regret Analysis of Retry-Aware Bandits

Add code
May 20, 2026
Viaarxiv icon

CITE: Anytime-Valid Statistical Inference in LLM Self-Consistency

Add code
May 07, 2026
Viaarxiv icon

An Efficient Algorithm for Thresholding Monte Carlo Tree Search

Add code
Jan 30, 2026
Viaarxiv icon

High-dimensional Nonparametric Contextual Bandit Problem

Add code
May 20, 2025
Viaarxiv icon

No-regret incentive-compatible online learning under exact truthfulness with non-myopic experts

Add code
Feb 17, 2025
Figure 1 for No-regret incentive-compatible online learning under exact truthfulness with non-myopic experts
Figure 2 for No-regret incentive-compatible online learning under exact truthfulness with non-myopic experts
Viaarxiv icon

Data-dependent Bounds with $T$-Optimal Best-of-Both-Worlds Guarantees in Multi-Armed Bandits using Stability-Penalty Matching

Add code
Feb 12, 2025
Figure 1 for Data-dependent Bounds with $T$-Optimal Best-of-Both-Worlds Guarantees in Multi-Armed Bandits using Stability-Penalty Matching
Viaarxiv icon