Picture for Jie Ma

Jie Ma

I Seek You in Videos: Identity-Conditioned Queries for Person-Centric Video Reasoning

Add code
Aug 07, 2026
Viaarxiv icon

MoRoute: Dynamic Routing for In-Context Multimodal Video Generation

Add code
Jul 31, 2026
Viaarxiv icon

Capturing Token Tendencies for Training-Free Token Pruning in Multimodal Large Language Models

Add code
Jul 30, 2026
Viaarxiv icon

One Reflection Is Not Enough: Self-Correcting Autonomous Research via Multi-Hypothesis Failure Attribution

Add code
Jun 30, 2026
Viaarxiv icon

Compression and Retrieval: Implicit Memory Retrieval for Video World Models

Add code
Jun 22, 2026
Viaarxiv icon

EvolveNav: Proactive Preflection and Self-Evolving Memory for Zero-Shot Object Goal Navigation

Add code
Jun 16, 2026
Viaarxiv icon

Look Less, Reason More: Block-wise Attention Skipping for Efficient Multimodal LLMs

Add code
Jun 07, 2026
Viaarxiv icon

SkyShield: Occupancy as a Safety Interface for Low-Altitude UAV Autonomy

Add code
May 30, 2026
Viaarxiv icon

SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control

Add code
May 27, 2026
Viaarxiv icon

Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems

Add code
May 14, 2026
Viaarxiv icon