Picture for Wenhang Shi

Wenhang Shi

RaBitQCache: Rotated Binary Quantization for KVCache in Long Context LLM Inference

Add code
Jun 30, 2026
Viaarxiv icon

Training Prompt Matters: State-Adaptive Optimization for Robust Fine-Tuning

Add code
Jun 01, 2026
Viaarxiv icon

Scaling Agentic Capabilities via Grounded Interaction Synthesis

Add code
Jun 01, 2026
Viaarxiv icon

Joint Knowledge Editing for Information Enrichment and Probability Promotion

Add code
Dec 22, 2024
Viaarxiv icon

A Two-Phase Recall-and-Select Framework for Fast Model Selection

Add code
Mar 28, 2024
Figure 1 for A Two-Phase Recall-and-Select Framework for Fast Model Selection
Figure 2 for A Two-Phase Recall-and-Select Framework for Fast Model Selection
Figure 3 for A Two-Phase Recall-and-Select Framework for Fast Model Selection
Figure 4 for A Two-Phase Recall-and-Select Framework for Fast Model Selection
Viaarxiv icon

Create and Find Flatness: Building Flat Training Spaces in Advance for Continual Learning

Add code
Sep 20, 2023
Figure 1 for Create and Find Flatness: Building Flat Training Spaces in Advance for Continual Learning
Figure 2 for Create and Find Flatness: Building Flat Training Spaces in Advance for Continual Learning
Figure 3 for Create and Find Flatness: Building Flat Training Spaces in Advance for Continual Learning
Figure 4 for Create and Find Flatness: Building Flat Training Spaces in Advance for Continual Learning
Viaarxiv icon

TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities

Add code
Dec 13, 2022
Figure 1 for TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities
Figure 2 for TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities
Figure 3 for TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities
Figure 4 for TencentPretrain: A Scalable and Flexible Toolkit for Pre-training Models of Different Modalities
Viaarxiv icon