Picture for Hong Jia

Hong Jia

MADBench: A Benchmark for Modality-Aware Audio Deepfake Detection

Add code
Aug 10, 2026
Viaarxiv icon

LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding

Add code
Aug 06, 2026
Viaarxiv icon

Straight-Path Flow Matching for Incomplete Multi-View Clustering

Add code
Jul 07, 2026
Viaarxiv icon

Efficient Multimodal Clinical Question Answering for Pulmonary Embolism Risk Assessment

Add code
Jun 21, 2026
Viaarxiv icon

RAIL: Rethinking Auditory Intelligence in Large Audio-Language Models with a CHC-Grounded Benchmark

Add code
Jun 09, 2026
Viaarxiv icon

Titans-as-a-Layer: Test-Time Memory for Conversational Speech Emotion Recognition

Add code
Jun 07, 2026
Viaarxiv icon

VitalAgent: A Tool-Augmented Agent for Reactive and Proactive Physiological Monitoring over Wearable Health Data

Add code
May 28, 2026
Viaarxiv icon

Pocket-Dentist: On-Device Dental Image Understanding via Efficient Multimodal Large Language Models

Add code
May 28, 2026
Viaarxiv icon

Why Can't They Remember? Uncovering Representation and Retrieval Bottlenecks in Multi-Turn Acoustic Memory

Add code
May 26, 2026
Viaarxiv icon

Do LLMs Need to See Everything? A Benchmark and Study of Failures in LLM-driven Smartphone Automation using Screentext vs. Screenshots

Add code
Apr 20, 2026
Viaarxiv icon