Picture for Haodong Li

Haodong Li

VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System

Add code
Jul 29, 2026
Viaarxiv icon

From RGB Generation to Dense Field Readout: Pixel-Space Dense Prediction with Text-to-Image Models

Add code
Jul 09, 2026
Viaarxiv icon

PerceptionRubrics: Calibrating Multimodal Evaluation to Human Perception

Add code
Jun 30, 2026
Viaarxiv icon

$φ$-Scene: Physically Grounded Image-to-3D Scene Reconstruction

Add code
Jun 19, 2026
Viaarxiv icon

Rethinking Backdoor Adversarial Unlearning through the Lens of Catastrophic Forgetting in Continual Learning

Add code
Jun 12, 2026
Viaarxiv icon

From Parameters to Feature Space: Task Arithmetic for Backdoor Mitigation in Model Merging

Add code
Jun 10, 2026
Viaarxiv icon

SIGMA: Semantic-Difference Instruction-Grounding Mask Annotator for Text-Driven Image Manipulation Localization

Add code
May 27, 2026
Viaarxiv icon

Repurposing and Evaluating the (In)Feasibility of Dataset Poisoning enabled Watermarking for Contrastive Learning

Add code
May 03, 2026
Viaarxiv icon

SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Environments

Add code
Apr 15, 2026
Viaarxiv icon

AgentFoX: LLM Agent-Guided Fusion with eXplainability for AI-Generated Image Detection

Add code
Mar 24, 2026
Viaarxiv icon