Picture for Zhijun Tu

Zhijun Tu

Stable FP4 Training via Transposition-Invariant Block Quantization

Add code
Jul 27, 2026
Viaarxiv icon

MEPA: Multi-Scale Representation Alignment for Visual Autoregressive Modeling with Mixture of Experts

Add code
Jul 01, 2026
Viaarxiv icon

Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models

Add code
Aug 09, 2025
Figure 1 for Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
Figure 2 for Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
Figure 3 for Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
Figure 4 for Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
Viaarxiv icon

Autoregressive Image Generation Guided by Chains of Thought

Add code
Feb 26, 2025
Viaarxiv icon

Effective Diffusion Transformer Architecture for Image Super-Resolution

Add code
Sep 29, 2024
Figure 1 for Effective Diffusion Transformer Architecture for Image Super-Resolution
Figure 2 for Effective Diffusion Transformer Architecture for Image Super-Resolution
Figure 3 for Effective Diffusion Transformer Architecture for Image Super-Resolution
Figure 4 for Effective Diffusion Transformer Architecture for Image Super-Resolution
Viaarxiv icon

One Step Diffusion-based Super-Resolution with Time-Aware Distillation

Add code
Aug 14, 2024
Viaarxiv icon

U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers

Add code
May 04, 2024
Figure 1 for U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
Figure 2 for U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
Figure 3 for U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
Figure 4 for U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
Viaarxiv icon

LIPT: Latency-aware Image Processing Transformer

Add code
Apr 09, 2024
Viaarxiv icon

IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions

Add code
Mar 31, 2024
Figure 1 for IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
Figure 2 for IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
Figure 3 for IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
Figure 4 for IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
Viaarxiv icon

A Survey on Transformer Compression

Add code
Feb 05, 2024
Figure 1 for A Survey on Transformer Compression
Figure 2 for A Survey on Transformer Compression
Figure 3 for A Survey on Transformer Compression
Figure 4 for A Survey on Transformer Compression
Viaarxiv icon