Picture for Siyuan Li

Siyuan Li

ArmorOCR: Grounded Adversarial Visual Perception via Observation-Transferred Self-Distillation

Add code
Aug 20, 2026
Viaarxiv icon

From Generalist to Specialist: A Context-Fusion Framework for Endoscopic Polyp Reporting with a Frozen VLM

Add code
Aug 16, 2026
Viaarxiv icon

ASTELD: A Six-Axis Classification Framework for Autonomous AI Agents - Design, Evaluation, and an OpenClaw Case Study

Add code
Aug 05, 2026
Viaarxiv icon

A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports

Add code
Jul 30, 2026
Viaarxiv icon

DVPSFormer: Efficient Online Depth-aware Video Panoptic Segmentation for Autonomous Driving

Add code
Jul 28, 2026
Viaarxiv icon

ConceptTree: Bringing Semantic Transparency to Black-Box Decision Making for Robotic Manipulation

Add code
Jul 20, 2026
Viaarxiv icon

OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers

Add code
Jul 04, 2026
Viaarxiv icon

Multimodal Knowledge Edit-Scoped Generalization for Online Recursive MLLM Editing

Add code
Jul 02, 2026
Viaarxiv icon

Progressive Pose-Guided 4D Animal Reconstruction from Monocular Video

Add code
Jun 30, 2026
Viaarxiv icon

Bridging Modal Isolation in Interleaved Thinking: Supervising Modality Transitions via Stepwise Reinforcement

Add code
Jun 11, 2026
Viaarxiv icon