Picture for Qihui Zhu

Qihui Zhu

HiRoute: Hierarchical Routed Prompt Tuning for Safety Alignment of Large Language Models

Add code
Aug 13, 2026
Viaarxiv icon

GSTEP: Global Spatio-Temporal Density-Driven Visual Token Pruning for Efficient Video Large Language Models

Add code
Aug 04, 2026
Viaarxiv icon

SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models

Add code
Jul 28, 2026
Viaarxiv icon

RP-OPSD: Resolution-Privileged On-Policy Self-Distillation for Multimodal Large Language Models

Add code
Jul 27, 2026
Viaarxiv icon

AlloSpatial: Agentic Harness Framework for Spatial Reasoning in Foundation Models

Add code
Jun 08, 2026
Viaarxiv icon

HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models

Add code
Apr 09, 2026
Viaarxiv icon

Improving Safety Alignment via Balanced Direct Preference Optimization

Add code
Mar 24, 2026
Viaarxiv icon

Mind over Space: Can Multimodal Large Language Models Mentally Navigate?

Add code
Mar 23, 2026
Viaarxiv icon

World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models

Add code
Mar 10, 2026
Viaarxiv icon

From reactive to cognitive: brain-inspired spatial intelligence for embodied agents

Add code
Aug 24, 2025
Figure 1 for From reactive to cognitive: brain-inspired spatial intelligence for embodied agents
Figure 2 for From reactive to cognitive: brain-inspired spatial intelligence for embodied agents
Figure 3 for From reactive to cognitive: brain-inspired spatial intelligence for embodied agents
Figure 4 for From reactive to cognitive: brain-inspired spatial intelligence for embodied agents
Viaarxiv icon