Picture for Tiantian Zhang

Tiantian Zhang

Crystal

Massive Activations in Hybrid Linear Attention Large Language Models: Pre-Attention Spikes and Inter-Spike Plateaus

Add code
Aug 12, 2026
Viaarxiv icon

Beyond Isolation: Unlocking Reinforcement Learning Component Synergy for Sample-Efficient Continuous Control

Add code
Aug 07, 2026
Viaarxiv icon

Mirror Horizon: Viable Path Entropy as a Measure of Bounded Reflection

Add code
Jul 11, 2026
Viaarxiv icon

Power Reinforcement Post-Training of Text-to-Image Models with Super-Linear Advantage Shaping

Add code
May 11, 2026
Viaarxiv icon

DDO-RM for LLM Preference Optimization: A Minimal Held-Out Benchmark against DPO

Add code
Apr 13, 2026
Viaarxiv icon

Few-for-Many Personalized Federated Learning

Add code
Mar 12, 2026
Viaarxiv icon

AirHunt: Bridging VLM Semantics and Continuous Planning for Efficient Aerial Object Navigation

Add code
Jan 19, 2026
Viaarxiv icon

UACER: An Uncertainty-Aware Critic Ensemble Framework for Robust Adversarial Reinforcement Learning

Add code
Dec 11, 2025
Viaarxiv icon

Sample By Step, Optimize By Chunk: Chunk-Level GRPO For Text-to-Image Generation

Add code
Oct 24, 2025
Figure 1 for Sample By Step, Optimize By Chunk: Chunk-Level GRPO For Text-to-Image Generation
Figure 2 for Sample By Step, Optimize By Chunk: Chunk-Level GRPO For Text-to-Image Generation
Figure 3 for Sample By Step, Optimize By Chunk: Chunk-Level GRPO For Text-to-Image Generation
Figure 4 for Sample By Step, Optimize By Chunk: Chunk-Level GRPO For Text-to-Image Generation
Viaarxiv icon

Distribution Preference Optimization: A Fine-grained Perspective for LLM Unlearning

Add code
Oct 06, 2025
Viaarxiv icon