Picture for Chuyan Chen

Chuyan Chen

CMuon: Accelerating and Stabilizing Diffusion Transformer Training via Chunked Momentum Orthogonalization

Add code
Aug 03, 2026
Viaarxiv icon

dRAE: Representation Autoencoder with Hyper-Spherical Codes

Add code
Jul 24, 2026
Viaarxiv icon

Self-Adversarial One Step Generation via Condition Shifting

Add code
Apr 14, 2026
Viaarxiv icon

An All-Reduce Compatible Top-K Compressor for Communication-Efficient Distributed Learning

Add code
Oct 30, 2025
Viaarxiv icon

Subspace Optimization for Large Language Models with Convergence Guarantees

Add code
Oct 15, 2024
Figure 1 for Subspace Optimization for Large Language Models with Convergence Guarantees
Figure 2 for Subspace Optimization for Large Language Models with Convergence Guarantees
Figure 3 for Subspace Optimization for Large Language Models with Convergence Guarantees
Figure 4 for Subspace Optimization for Large Language Models with Convergence Guarantees
Viaarxiv icon