Picture for Kewei Tu

Kewei Tu

S$^4$R: Selective Sampling, Subspaces, and Sparse Reconstruction for Compressed Long-Context KV Caching

Add code
Aug 01, 2026
Viaarxiv icon

Evolution-Aware MSA Reasoning for Subsampling via Factor Graphs

Add code
Jul 24, 2026
Viaarxiv icon

Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling

Add code
Jul 03, 2026
Viaarxiv icon

Does Traversal Order Matter? A Systematic Study of Tree Traversal Methods in Transformer Grammars

Add code
Jun 15, 2026
Viaarxiv icon

GRKV: Global Regression for Training-Free KV Cache Compression in Long-Context LLMs

Add code
May 29, 2026
Viaarxiv icon

Scaling Probabilistic Transformer via Efficient Cross-Scale Hyperparameter Transfer

Add code
Apr 28, 2026
Viaarxiv icon

YOCO++: Enhancing YOCO with KV Residual Connections for Efficient LLM Inference

Add code
Apr 15, 2026
Viaarxiv icon

Efficient Multimodal Planning Agent for Visual Question-Answering

Add code
Jan 28, 2026
Viaarxiv icon

EvolveSearch: An Iterative Self-Evolving Search Agent

Add code
May 28, 2025
Viaarxiv icon

Random Long-Context Access for Mamba via Hardware-aligned Hierarchical Sparse Attention

Add code
Apr 23, 2025
Figure 1 for Random Long-Context Access for Mamba via Hardware-aligned Hierarchical Sparse Attention
Figure 2 for Random Long-Context Access for Mamba via Hardware-aligned Hierarchical Sparse Attention
Figure 3 for Random Long-Context Access for Mamba via Hardware-aligned Hierarchical Sparse Attention
Figure 4 for Random Long-Context Access for Mamba via Hardware-aligned Hierarchical Sparse Attention
Viaarxiv icon