Picture for Guannan Qu

Guannan Qu

DeltaMomentum: A Key-Value based Anisotropic Momentum Update via Delta Rule

Add code
Aug 19, 2026
Viaarxiv icon

Hybrid Feedback Sampling for Sample-Efficient Model Predictive Control

Add code
Aug 19, 2026
Viaarxiv icon

A Theoretical Framework for Parallel Lifelong MAPF Using Group Decentralized Planning

Add code
Aug 18, 2026
Viaarxiv icon

Emergent and Subliminal Misalignment Through the Lens of Data-Mediated Transfer

Add code
May 12, 2026
Viaarxiv icon

Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with $k$-step Policy Gradients

Add code
May 11, 2026
Viaarxiv icon

Towards Effective Theory of LLMs: A Representation Learning Approach

Add code
May 10, 2026
Viaarxiv icon

BLOCK-EM: Preventing Emergent Misalignment by Blocking Causal Features

Add code
Jan 31, 2026
Viaarxiv icon

Polynomial Convergence of Riemannian Diffusion Models

Add code
Jan 05, 2026
Viaarxiv icon

Transformer-Based Scalable Multi-Agent Reinforcement Learning for Networked Systems with Long-Range Interactions

Add code
Nov 17, 2025
Viaarxiv icon

Comparative Field Deployment of Reinforcement Learning and Model Predictive Control for Residential HVAC

Add code
Oct 01, 2025
Figure 1 for Comparative Field Deployment of Reinforcement Learning and Model Predictive Control for Residential HVAC
Figure 2 for Comparative Field Deployment of Reinforcement Learning and Model Predictive Control for Residential HVAC
Figure 3 for Comparative Field Deployment of Reinforcement Learning and Model Predictive Control for Residential HVAC
Figure 4 for Comparative Field Deployment of Reinforcement Learning and Model Predictive Control for Residential HVAC
Viaarxiv icon