Picture for Yu Yamaguchi

Yu Yamaguchi

STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes

Add code
Aug 14, 2025
Viaarxiv icon

One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression

Add code
Jan 17, 2025
Figure 1 for One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression
Figure 2 for One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression
Figure 3 for One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression
Figure 4 for One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression
Viaarxiv icon

ACT-Bench: Towards Action Controllable World Models for Autonomous Driving

Add code
Dec 06, 2024
Figure 1 for ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
Figure 2 for ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
Figure 3 for ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
Figure 4 for ACT-Bench: Towards Action Controllable World Models for Autonomous Driving
Viaarxiv icon

CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving

Add code
Aug 19, 2024
Figure 1 for CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
Figure 2 for CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
Figure 3 for CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
Figure 4 for CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving
Viaarxiv icon

Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese

Add code
Apr 11, 2024
Figure 1 for Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
Figure 2 for Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
Figure 3 for Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
Figure 4 for Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
Viaarxiv icon

Evaluation of Large Language Models for Decision Making in Autonomous Driving

Add code
Dec 11, 2023
Figure 1 for Evaluation of Large Language Models for Decision Making in Autonomous Driving
Figure 2 for Evaluation of Large Language Models for Decision Making in Autonomous Driving
Figure 3 for Evaluation of Large Language Models for Decision Making in Autonomous Driving
Figure 4 for Evaluation of Large Language Models for Decision Making in Autonomous Driving
Viaarxiv icon

NuScenes-MQA: Integrated Evaluation of Captions and QA for Autonomous Driving Datasets using Markup Annotations

Add code
Dec 11, 2023
Figure 1 for NuScenes-MQA: Integrated Evaluation of Captions and QA for Autonomous Driving Datasets using Markup Annotations
Figure 2 for NuScenes-MQA: Integrated Evaluation of Captions and QA for Autonomous Driving Datasets using Markup Annotations
Figure 3 for NuScenes-MQA: Integrated Evaluation of Captions and QA for Autonomous Driving Datasets using Markup Annotations
Figure 4 for NuScenes-MQA: Integrated Evaluation of Captions and QA for Autonomous Driving Datasets using Markup Annotations
Viaarxiv icon