Picture for Yuchen Zhang

Yuchen Zhang

Jack

CLARA: Clip-Level Multimodal Alignment with VLM-Derived Rationales for Hateful Video Detection

Add code
Aug 16, 2026
Viaarxiv icon

VOLA: Improving Open-World Driving by VLM-Based Semantic Attribute Prediction

Add code
Aug 12, 2026
Viaarxiv icon

AirFlow: Context Preserving and Multi-Rate State Modeling for Air Quality Forecasting

Add code
Aug 10, 2026
Viaarxiv icon

Science Edge Evaluation: SEE the Missing Step Toward Real Scientific Discovery

Add code
Aug 07, 2026
Viaarxiv icon

Multi-User Localization via Active Sensing with Electromagnetically Reconfigurable Antennas

Add code
Jul 29, 2026
Viaarxiv icon

CARD: Cross-component Audio Representation Distillation for Encoder-Free Audio Captioning

Add code
Jul 06, 2026
Viaarxiv icon

Text-Driven 3D Indoor Scene Synthesis in Non-Manhattan Environments

Add code
Jul 02, 2026
Viaarxiv icon

Robust 3D Alignment of Generative Reconstructions via Partial Monocular Observations

Add code
Jul 01, 2026
Viaarxiv icon

How Many RF Chains Does a Microwave Linear Analog Computer (MiLAC) Need to Match the Fully-Digital Cramér-Rao Bound?

Add code
Jun 22, 2026
Viaarxiv icon

What Shapes Emergent Misalignment? Insights from Training Dynamics, Model Priors, and Data

Add code
Jun 18, 2026
Viaarxiv icon