Picture for Zhi Yao

Zhi Yao

FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference

Add code
Jul 30, 2026
Viaarxiv icon

MemTxn: A Transaction Boundary for Source-Supported Updates and Complete-State Recovery in Agent Memory

Add code
Jul 30, 2026
Viaarxiv icon

CONCORD: Asynchronous Sparse Aggregation for Device-Cloud RAG under Document Isolation

Add code
Jun 13, 2026
Viaarxiv icon

CogGuard: Cognitive and Operational Profiling for Proactive Warning in Edge Intelligent Services

Add code
Jun 13, 2026
Viaarxiv icon

Semantic Cache Distillation: Efficient State Transfer via Reuse and Selective Patching

Add code
Jun 05, 2026
Viaarxiv icon

Not All Frames Deserve Full Computation: Accelerating Autoregressive Video Generation via Selective Computation and Predictive Extrapolation

Add code
Apr 03, 2026
Viaarxiv icon

MatterChat: A Multi-Modal LLM for Material Science

Add code
Feb 18, 2025
Figure 1 for MatterChat: A Multi-Modal LLM for Material Science
Figure 2 for MatterChat: A Multi-Modal LLM for Material Science
Figure 3 for MatterChat: A Multi-Modal LLM for Material Science
Figure 4 for MatterChat: A Multi-Modal LLM for Material Science
Viaarxiv icon

VELO: A Vector Database-Assisted Cloud-Edge Collaborative LLM QoS Optimization Framework

Add code
Jun 19, 2024
Figure 1 for VELO: A Vector Database-Assisted Cloud-Edge Collaborative LLM QoS Optimization Framework
Figure 2 for VELO: A Vector Database-Assisted Cloud-Edge Collaborative LLM QoS Optimization Framework
Figure 3 for VELO: A Vector Database-Assisted Cloud-Edge Collaborative LLM QoS Optimization Framework
Figure 4 for VELO: A Vector Database-Assisted Cloud-Edge Collaborative LLM QoS Optimization Framework
Viaarxiv icon