Picture for Yuu Jinnai

Yuu Jinnai

Orienteering Problem with Uncertain Time-Varying Rewards: Framework and Benchmark for Everyday Service Robotics

Add code
Aug 19, 2026
Viaarxiv icon

JOR-Bench: Japanese Operations Research Benchmarks for Large Language Models

Add code
Jul 18, 2026
Viaarxiv icon

Cost of Reasoning in non-English Languages: A Case Study on Japanese

Add code
Jul 11, 2026
Viaarxiv icon

CAT-Translate: Building Compact Open-Source Models for Japanese-English Translation

Add code
Jun 19, 2026
Viaarxiv icon

Consensus Group Relative Policy Optimization for Text Generation

Add code
Feb 03, 2026
Viaarxiv icon

MO-GRPO: Mitigating Reward Hacking of Group Relative Policy Optimization on Multi-Objective Problems

Add code
Sep 26, 2025
Viaarxiv icon

Document-Level Text Generation with Minimum Bayes Risk Decoding using Optimal Transport

Add code
May 29, 2025
Viaarxiv icon

Theoretical Guarantees for Minimum Bayes Risk Decoding

Add code
Feb 18, 2025
Viaarxiv icon

Evaluation of Best-of-N Sampling Strategies for Language Model Alignment

Add code
Feb 18, 2025
Figure 1 for Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
Figure 2 for Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
Figure 3 for Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
Figure 4 for Evaluation of Best-of-N Sampling Strategies for Language Model Alignment
Viaarxiv icon

Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?

Add code
Jun 24, 2024
Viaarxiv icon