Picture for Zihan Ma

Zihan Ma

Listen, See and Track: Spatio-Temporal Audio-Visual Sound Event Reasoning for Omni-Modal Language Models

Add code
Aug 10, 2026
Viaarxiv icon

T3HG-Editor: Text-driven 3D Human Garment Editing with Body Priors Embedded in SMPL-X

Add code
Jul 15, 2026
Viaarxiv icon

FPED: A Functional-Network Prior-Guided Mixture-of-Experts Framework for Interpretable Brain Decoding

Add code
May 19, 2026
Viaarxiv icon

Rethinking Positional Encoding for Neural Vehicle Routing

Add code
May 12, 2026
Viaarxiv icon

EvoNav: Evolutionary Reward Function Design for Robot Navigation with Large Language Models

Add code
May 12, 2026
Viaarxiv icon

HyNeuralMap: Hyperbolic Mapping of Visual Semantics to Neural Hierarchies

Add code
May 10, 2026
Viaarxiv icon

From Manipulation to Mistrust: Explaining Diverse Micro-Video Misinformation for Robust Debunking in the Wild

Add code
Mar 26, 2026
Viaarxiv icon

JudgeFlow: Agentic Workflow Optimization via Block Judge

Add code
Jan 12, 2026
Viaarxiv icon

ATLAS: A High-Difficulty, Multidisciplinary Benchmark for Frontier Scientific Reasoning

Add code
Nov 18, 2025
Viaarxiv icon

How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity

Add code
Nov 11, 2025
Figure 1 for How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
Figure 2 for How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
Figure 3 for How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
Figure 4 for How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
Viaarxiv icon