Picture for Ling Zhang

Ling Zhang

Missouri S&T EMC Laboratory, Rolla, MO, USA

HounsWorld: A Multimodal World Model for Hidden Patient-State Readout, Reconstruction, and Simulation

Add code
Aug 13, 2026
Viaarxiv icon

EndoVLM: An Endoscopy Vision-Language Pre-training Model via Anatomy-Guided Sparsity and Progressive Alignment

Add code
Aug 05, 2026
Viaarxiv icon

Surgical Re-enactment for Operating Room Workflow Datasets

Add code
Jul 27, 2026
Viaarxiv icon

RadSight: Towards Perceptually Reliable Multimodal Radiology Image Understanding

Add code
Jul 24, 2026
Viaarxiv icon

Super-Generalist: Towards Comprehensive and Accurate Medical Image Understanding via Generalist-Specialist Synergy

Add code
Jul 10, 2026
Viaarxiv icon

Always-OnAgents:A Survey of Persistent Memory, State, and Governance in LLMAgents

Add code
Jun 29, 2026
Viaarxiv icon

Disease-Centric Vision-Language Pretraining with Hybrid Visual Encoding for 3D Computed Tomography

Add code
Jun 24, 2026
Viaarxiv icon

E-MRL: Cross-view Aligned Evidence-driven Multimodal Reinforcement Learning for Reliable 3D Tumor Analysis

Add code
Jun 22, 2026
Viaarxiv icon

BreastGPT: A Multimodal Large Language Model for the Full Spectrum of Breast Cancer Clinical Routine

Add code
Jun 03, 2026
Viaarxiv icon

Regulating Anatomy-Aware Rewards via Trajectory-Integral Feedback for Volumetric Computed Tomography Analysis

Add code
May 19, 2026
Viaarxiv icon