Picture for Bingnan Li

Bingnan Li

AVA-Encoder: Towards Agent-Native Video Representation Learning

Add code
Aug 12, 2026
Viaarxiv icon

What to Edit Next: Visually Aligned Image-Editing Follow-Up Suggestions in Conversational Systems

Add code
Aug 03, 2026
Viaarxiv icon

Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation

Add code
Jul 27, 2026
Viaarxiv icon

DLLG: Dynamic Logit-Level Gating of LLM Experts

Add code
Jun 03, 2026
Viaarxiv icon

CyCLeGen: Cycle-Consistent Layout Prediction and Image Generation in Vision Foundation Models

Add code
Mar 16, 2026
Viaarxiv icon

YOLO-Count: Differentiable Object Counting for Text-to-Image Generation

Add code
Aug 01, 2025
Figure 1 for YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
Figure 2 for YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
Figure 3 for YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
Figure 4 for YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
Viaarxiv icon

Generalize or Detect? Towards Robust Semantic Segmentation Under Multiple Distribution Shifts

Add code
Nov 06, 2024
Figure 1 for Generalize or Detect? Towards Robust Semantic Segmentation Under Multiple Distribution Shifts
Figure 2 for Generalize or Detect? Towards Robust Semantic Segmentation Under Multiple Distribution Shifts
Figure 3 for Generalize or Detect? Towards Robust Semantic Segmentation Under Multiple Distribution Shifts
Figure 4 for Generalize or Detect? Towards Robust Semantic Segmentation Under Multiple Distribution Shifts
Viaarxiv icon

Gradient-Map-Guided Adaptive Domain Generalization for Cross Modality MRI Segmentation

Add code
Nov 16, 2023
Viaarxiv icon