Picture for Yuxing Long

Yuxing Long

Scaling Manual-Grounded Appliance Manipulation with Data Synthesis and Unified Planning

Add code
Aug 16, 2026
Viaarxiv icon

VTInstructor: Visual Trajectory Prompting for Navigation Instruction Generation in Continuous Environments

Add code
Aug 15, 2026
Viaarxiv icon

Embodied3DBench: Benchmarking Low-Level Embodied Spatial Intelligence of Vision Language Models

Add code
May 27, 2026
Viaarxiv icon

CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model

Add code
Aug 14, 2025
Viaarxiv icon

CheckManual: A New Challenge and Benchmark for Manual-based Appliance Manipulation

Add code
Jun 11, 2025
Viaarxiv icon

InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment

Add code
Jun 07, 2024
Figure 1 for InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Figure 2 for InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Figure 3 for InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Figure 4 for InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Viaarxiv icon

ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation

Add code
Dec 24, 2023
Figure 1 for ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
Figure 2 for ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
Figure 3 for ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
Figure 4 for ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
Viaarxiv icon

Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill

Add code
Sep 21, 2023
Figure 1 for Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill
Figure 2 for Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill
Figure 3 for Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill
Figure 4 for Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill
Viaarxiv icon

Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions

Add code
Sep 20, 2023
Figure 1 for Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions
Figure 2 for Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions
Figure 3 for Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions
Figure 4 for Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions
Viaarxiv icon

VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue

Add code
Sep 14, 2023
Figure 1 for VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue
Figure 2 for VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue
Figure 3 for VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue
Figure 4 for VDialogUE: A Unified Evaluation Benchmark for Visually-grounded Dialogue
Viaarxiv icon