Picture for Yu Shi

Yu Shi

ConceptFormer: Learning Adaptive Latent Concepts for Query-Document Alignment in Visual Document Retrieval

Add code
Aug 16, 2026
Viaarxiv icon

Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety

Add code
Aug 13, 2026
Viaarxiv icon

When Latents Forget Pixels: Restoring Fidelity in Diffusion Transformer Super-Resolution

Add code
Aug 10, 2026
Viaarxiv icon

WHALE: A Scalable Unified Model for Recommendation with Wukong-HSTU Architecture

Add code
Jul 19, 2026
Viaarxiv icon

Super-Generalist: Towards Comprehensive and Accurate Medical Image Understanding via Generalist-Specialist Synergy

Add code
Jul 10, 2026
Viaarxiv icon

Beyond Uniform Token-Level Trust Region in LLM Reinforcement Learning

Add code
Jun 09, 2026
Viaarxiv icon

BreastGPT: A Multimodal Large Language Model for the Full Spectrum of Breast Cancer Clinical Routine

Add code
Jun 03, 2026
Viaarxiv icon

Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition

Add code
May 11, 2026
Viaarxiv icon

Opportunistic Bone-Loss Screening from Routine Knee Radiographs Using a Multi-Task Deep Learning Framework with Sensitivity-Constrained Threshold Optimization

Add code
Apr 22, 2026
Viaarxiv icon

Degradation-Robust Fusion: An Efficient Degradation-Aware Diffusion Framework for Multimodal Image Fusion in Arbitrary Degradation Scenarios

Add code
Apr 10, 2026
Viaarxiv icon