Picture for Anh Dao

Anh Dao

OpenBelief-Nav: Evidence-Preserving Object Memory for Open-Vocabulary Language-Guided Navigation

Add code
Aug 14, 2026
Viaarxiv icon

HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments

Add code
Aug 13, 2026
Viaarxiv icon

Beyond Motion Pattern: An Empirical Study of Physical Forces for Human Motion Understanding

Add code
Dec 23, 2025
Figure 1 for Beyond Motion Pattern: An Empirical Study of Physical Forces for Human Motion Understanding
Figure 2 for Beyond Motion Pattern: An Empirical Study of Physical Forces for Human Motion Understanding
Figure 3 for Beyond Motion Pattern: An Empirical Study of Physical Forces for Human Motion Understanding
Figure 4 for Beyond Motion Pattern: An Empirical Study of Physical Forces for Human Motion Understanding
Viaarxiv icon

VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results

Add code
Sep 11, 2025
Figure 1 for VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results
Figure 2 for VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results
Figure 3 for VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results
Figure 4 for VQualA 2025 Challenge on Visual Quality Comparison for Large Multimodal Models: Methods and Results
Viaarxiv icon

IndustryEQA: Pushing the Frontiers of Embodied Question Answering in Industrial Scenarios

Add code
May 27, 2025
Viaarxiv icon

Cycle Training with Semi-Supervised Domain Adaptation: Bridging Accuracy and Efficiency for Real-Time Mobile Scene Detection

Add code
Apr 12, 2025
Viaarxiv icon

Towards Efficient and Robust Moment Retrieval System: A Unified Framework for Multi-Granularity Models and Temporal Reranking

Add code
Apr 11, 2025
Viaarxiv icon

Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs

Add code
Feb 18, 2025
Figure 1 for Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs
Figure 2 for Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs
Figure 3 for Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs
Figure 4 for Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs
Viaarxiv icon

Visual Large Language Models for Generalized and Specialized Applications

Add code
Jan 06, 2025
Figure 1 for Visual Large Language Models for Generalized and Specialized Applications
Figure 2 for Visual Large Language Models for Generalized and Specialized Applications
Figure 3 for Visual Large Language Models for Generalized and Specialized Applications
Figure 4 for Visual Large Language Models for Generalized and Specialized Applications
Viaarxiv icon

LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task

Add code
Jul 16, 2024
Figure 1 for LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
Figure 2 for LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
Figure 3 for LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
Figure 4 for LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
Viaarxiv icon