Picture for Yutaka Satoh

Yutaka Satoh

National Institute of Advanced Industrial Science and Technology

Beyond Single Object: Learning 3D Relations with Large Language Models

Add code
Aug 16, 2026
Viaarxiv icon

Seeing Red, Thinking Bad: Color Bias in Vision Language Models

Add code
Aug 14, 2026
Viaarxiv icon

Guidelines for External Disturbance Factors in the Use of OCR in Real-World Environments

Add code
Apr 21, 2025
Viaarxiv icon

Estimation of Human Condition at Disaster Site Using Aerial Drone Images

Add code
Aug 08, 2023
Figure 1 for Estimation of Human Condition at Disaster Site Using Aerial Drone Images
Figure 2 for Estimation of Human Condition at Disaster Site Using Aerial Drone Images
Figure 3 for Estimation of Human Condition at Disaster Site Using Aerial Drone Images
Figure 4 for Estimation of Human Condition at Disaster Site Using Aerial Drone Images
Viaarxiv icon

Describing and Localizing Multiple Changes with Transformers

Add code
Mar 25, 2021
Figure 1 for Describing and Localizing Multiple Changes with Transformers
Figure 2 for Describing and Localizing Multiple Changes with Transformers
Figure 3 for Describing and Localizing Multiple Changes with Transformers
Figure 4 for Describing and Localizing Multiple Changes with Transformers
Viaarxiv icon

Pre-training without Natural Images

Add code
Jan 21, 2021
Figure 1 for Pre-training without Natural Images
Figure 2 for Pre-training without Natural Images
Figure 3 for Pre-training without Natural Images
Figure 4 for Pre-training without Natural Images
Viaarxiv icon

Weakly Supervised Dataset Collection for Robust Person Detection

Add code
May 01, 2020
Figure 1 for Weakly Supervised Dataset Collection for Robust Person Detection
Figure 2 for Weakly Supervised Dataset Collection for Robust Person Detection
Figure 3 for Weakly Supervised Dataset Collection for Robust Person Detection
Figure 4 for Weakly Supervised Dataset Collection for Robust Person Detection
Viaarxiv icon

Would Mega-scale Datasets Further Enhance Spatiotemporal 3D CNNs?

Add code
Apr 10, 2020
Figure 1 for Would Mega-scale Datasets Further Enhance Spatiotemporal 3D CNNs?
Figure 2 for Would Mega-scale Datasets Further Enhance Spatiotemporal 3D CNNs?
Figure 3 for Would Mega-scale Datasets Further Enhance Spatiotemporal 3D CNNs?
Figure 4 for Would Mega-scale Datasets Further Enhance Spatiotemporal 3D CNNs?
Viaarxiv icon

Anticipating Traffic Accidents with Adaptive Loss and Large-scale Incident DB

Add code
Apr 08, 2018
Figure 1 for Anticipating Traffic Accidents with Adaptive Loss and Large-scale Incident DB
Figure 2 for Anticipating Traffic Accidents with Adaptive Loss and Large-scale Incident DB
Figure 3 for Anticipating Traffic Accidents with Adaptive Loss and Large-scale Incident DB
Figure 4 for Anticipating Traffic Accidents with Adaptive Loss and Large-scale Incident DB
Viaarxiv icon

Drive Video Analysis for the Detection of Traffic Near-Miss Incidents

Add code
Apr 07, 2018
Figure 1 for Drive Video Analysis for the Detection of Traffic Near-Miss Incidents
Figure 2 for Drive Video Analysis for the Detection of Traffic Near-Miss Incidents
Figure 3 for Drive Video Analysis for the Detection of Traffic Near-Miss Incidents
Figure 4 for Drive Video Analysis for the Detection of Traffic Near-Miss Incidents
Viaarxiv icon