Picture for Takeshi Kojima

Takeshi Kojima

Bootstrapping Niche Multilingual Code Translation via Reinforcement Learning with Execution-Based Verifiable Supervision

Add code
Aug 14, 2026
Viaarxiv icon

Batch-wise Adaptive Pruning: Periodic Neuron Activation-Aware Weight Pruning for Language Reasoning Model

Add code
Aug 14, 2026
Viaarxiv icon

Looped State-Space Language Models with Adaptive Exit-State Selection

Add code
Jul 11, 2026
Viaarxiv icon

OrderGrad: Optimizing Beyond the Mean with Order-Statistic Policy Gradient Estimation

Add code
Jun 04, 2026
Viaarxiv icon

On Advantage Estimates for Max@K Policy Gradients

Add code
Jun 04, 2026
Viaarxiv icon

Clustered Self-Assessment: A Simple yet Effective Method for Uncertainty Quantification in Large Language Models

Add code
Jun 02, 2026
Viaarxiv icon

Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training

Add code
May 27, 2026
Viaarxiv icon

Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models

Add code
Mar 20, 2026
Viaarxiv icon

ClinDet-Bench: Beyond Abstention, Evaluating Judgment Determinability of LLMs in Clinical Decision-Making

Add code
Feb 26, 2026
Viaarxiv icon

Emergent Analogical Reasoning in Transformers

Add code
Feb 03, 2026
Viaarxiv icon