Picture for Hao Mark Chen

Hao Mark Chen

AcceptMoE: Commitment-Weighted Self-Sizing Verifier Expert Sets for Efficient MoE Speculative Decoding

Add code
Aug 04, 2026
Viaarxiv icon

AOSpec: Action and Observation Co-Speculation for Low-Latency Agent Serving

Add code
Aug 01, 2026
Viaarxiv icon

Model Guides You How to Draw: Adaptive Visual Gating for Unified Multimodal Reasoning

Add code
Jul 10, 2026
Viaarxiv icon

Context Memorization for Efficient Long Context Generation

Add code
May 18, 2026
Viaarxiv icon

Dynamic Expert Sharing: Decoupling Memory from Parallelism in Mixture-of-Experts Diffusion LLMs

Add code
Jan 31, 2026
Viaarxiv icon

Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling

Add code
May 16, 2025
Viaarxiv icon

FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization

Add code
Mar 16, 2025
Viaarxiv icon

Progressive Mixed-Precision Decoding for Efficient LLM Inference

Add code
Oct 17, 2024
Figure 1 for Progressive Mixed-Precision Decoding for Efficient LLM Inference
Figure 2 for Progressive Mixed-Precision Decoding for Efficient LLM Inference
Figure 3 for Progressive Mixed-Precision Decoding for Efficient LLM Inference
Figure 4 for Progressive Mixed-Precision Decoding for Efficient LLM Inference
Viaarxiv icon

Enhancing Dropout-based Bayesian Neural Networks with Multi-Exit on FPGA

Add code
Jun 24, 2024
Viaarxiv icon

Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA

Add code
Jun 23, 2024
Figure 1 for Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
Figure 2 for Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
Figure 3 for Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
Figure 4 for Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
Viaarxiv icon