Picture for Fang Li

Fang Li

JD.com

Bootstrapping Vision-Language Model for Hysteroscopic Surgical Scene Segmentation

Add code
Aug 11, 2026
Viaarxiv icon

Energy-Guided Flow Matching

Add code
Aug 07, 2026
Viaarxiv icon

iFAN: Inference-Aware Learning for Plain Mask Transformers

Add code
Aug 07, 2026
Viaarxiv icon

TRCoRSurg: Temporal-Relational Co-Reasoning for Surgical Video Triplet Recognition

Add code
Aug 05, 2026
Viaarxiv icon

VoxStruct3D: Structure-Leading Flow Matching for Voxel-Space 3D MRI Synthesis

Add code
Aug 05, 2026
Viaarxiv icon

Recompute or Reuse? Diagnosing and Mitigating Textual Shortcuts in VLM Self-Reflection

Add code
Aug 03, 2026
Viaarxiv icon

Kimi K3: Open Frontier Intelligence

Add code
Jul 27, 2026
Viaarxiv icon

GeoWorldAD: Geometry World Action Model for Autonomous Driving

Add code
Jul 20, 2026
Viaarxiv icon

DriveVer: Lightweight Trajectory Evaluator as Test-Time Verifier for Autonomous Driving

Add code
Jul 01, 2026
Viaarxiv icon

EyeMVP: OCT-Informed Fundus Representation Learning via Paired CFP--OCT Pretraining

Add code
Jun 13, 2026
Viaarxiv icon