Picture for Xiaoyao Liang

Xiaoyao Liang

Algorithm-Architecture Co-Design for Efficient VLA Inference via Speculative Inference and Verification

Add code
Aug 16, 2026
Viaarxiv icon

DeGS: A Scalable 3DGS Architecture via Decoupled Workload Parsing and Reorganization

Add code
Aug 03, 2026
Viaarxiv icon

A Motion-Aware Vector Quantization Framework with Centroid Reuse for Efficient VLA Inference

Add code
Jul 27, 2026
Viaarxiv icon

DALI: A Workload-Aware Offloading Framework for Efficient MoE Inference on Local PCs

Add code
Feb 03, 2026
Viaarxiv icon

Scene-Adaptive Motion Planning with Explicit Mixture of Experts and Interaction-Oriented Optimization

Add code
May 18, 2025
Figure 1 for Scene-Adaptive Motion Planning with Explicit Mixture of Experts and Interaction-Oriented Optimization
Figure 2 for Scene-Adaptive Motion Planning with Explicit Mixture of Experts and Interaction-Oriented Optimization
Figure 3 for Scene-Adaptive Motion Planning with Explicit Mixture of Experts and Interaction-Oriented Optimization
Figure 4 for Scene-Adaptive Motion Planning with Explicit Mixture of Experts and Interaction-Oriented Optimization
Viaarxiv icon

MEGA: A Memory-Efficient GNN Accelerator Exploiting Degree-Aware Mixed-Precision Quantization

Add code
Nov 16, 2023
Figure 1 for MEGA: A Memory-Efficient GNN Accelerator Exploiting Degree-Aware Mixed-Precision Quantization
Figure 2 for MEGA: A Memory-Efficient GNN Accelerator Exploiting Degree-Aware Mixed-Precision Quantization
Figure 3 for MEGA: A Memory-Efficient GNN Accelerator Exploiting Degree-Aware Mixed-Precision Quantization
Figure 4 for MEGA: A Memory-Efficient GNN Accelerator Exploiting Degree-Aware Mixed-Precision Quantization
Viaarxiv icon

$\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural Networks

Add code
Feb 01, 2023
Figure 1 for $\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural Networks
Figure 2 for $\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural Networks
Figure 3 for $\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural Networks
Figure 4 for $\rm A^2Q$: Aggregation-Aware Quantization for Graph Neural Networks
Viaarxiv icon

BayesFT: Bayesian Optimization for Fault Tolerant Neural Network Architecture

Add code
Sep 30, 2022
Figure 1 for BayesFT: Bayesian Optimization for Fault Tolerant Neural Network Architecture
Figure 2 for BayesFT: Bayesian Optimization for Fault Tolerant Neural Network Architecture
Figure 3 for BayesFT: Bayesian Optimization for Fault Tolerant Neural Network Architecture
Figure 4 for BayesFT: Bayesian Optimization for Fault Tolerant Neural Network Architecture
Viaarxiv icon

DNN Training Acceleration via Exploring GPGPU Friendly Sparsity

Add code
Mar 11, 2022
Figure 1 for DNN Training Acceleration via Exploring GPGPU Friendly Sparsity
Figure 2 for DNN Training Acceleration via Exploring GPGPU Friendly Sparsity
Figure 3 for DNN Training Acceleration via Exploring GPGPU Friendly Sparsity
Figure 4 for DNN Training Acceleration via Exploring GPGPU Friendly Sparsity
Viaarxiv icon

CP-ViT: Cascade Vision Transformer Pruning via Progressive Sparsity Prediction

Add code
Mar 09, 2022
Figure 1 for CP-ViT: Cascade Vision Transformer Pruning via Progressive Sparsity Prediction
Figure 2 for CP-ViT: Cascade Vision Transformer Pruning via Progressive Sparsity Prediction
Figure 3 for CP-ViT: Cascade Vision Transformer Pruning via Progressive Sparsity Prediction
Figure 4 for CP-ViT: Cascade Vision Transformer Pruning via Progressive Sparsity Prediction
Viaarxiv icon