Picture for Yusuke Oda

Yusuke Oda

Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining

Add code
Aug 13, 2026
Viaarxiv icon

Detecting Sensitive Personal Information in Japanese Pre-Training Corpora for Large Language Models

Add code
Jun 10, 2026
Viaarxiv icon

HakushoBench: A Japanese Chart and Table VQA Benchmark from Governmental White Papers

Add code
May 31, 2026
Viaarxiv icon

ABMAMBA: Multimodal Large Language Model with Aligned Hierarchical Bidirectional Scan for Efficient Video Captioning

Add code
Apr 09, 2026
Viaarxiv icon

Jagle: Building a Large-Scale Japanese Multimodal Post-Training Dataset for Vision-Language Models

Add code
Apr 02, 2026
Viaarxiv icon

JAMMEval: A Refined Collection of Japanese Benchmarks for Reliable VLM Evaluation

Add code
Apr 01, 2026
Viaarxiv icon

HiFlow: Tokenization-Free Scale-Wise Autoregressive Policy Learning via Flow Matching

Add code
Mar 28, 2026
Viaarxiv icon

ShapleyLaw: A Game-Theoretic Approach to Multilingual Scaling Laws

Add code
Mar 18, 2026
Viaarxiv icon

ReMoRa: Multimodal Large Language Model based on Refined Motion Representation for Long-Video Understanding

Add code
Feb 18, 2026
Viaarxiv icon

Instability in Downstream Task Performance During LLM Pretraining

Add code
Oct 06, 2025
Viaarxiv icon