Picture for Xiaoyi Pang

Xiaoyi Pang

WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models

Add code
Aug 05, 2026
Viaarxiv icon

OPTD: On-Policy Transition Distillation with Consistency-Guided Adaptive Compression for Few-Step Diffusion Language Models

Add code
Aug 03, 2026
Viaarxiv icon

RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy

Add code
Jul 30, 2026
Viaarxiv icon

Attention-Free and Lightweight Token Reduction for Efficient Vision-Language Models

Add code
Jul 15, 2026
Viaarxiv icon

Mitigating Bias in Low-SNR Financial Reinforcement Learning via Quantum Representations

Add code
Jun 09, 2026
Viaarxiv icon

DualSentinel: A Lightweight Framework for Detecting Targeted Attacks in Black-box LLM via Dual Entropy Lull Pattern

Add code
Mar 02, 2026
Viaarxiv icon

HALO: A Unified Vision-Language-Action Model for Embodied Multimodal Chain-of-Thought Reasoning

Add code
Feb 24, 2026
Viaarxiv icon

TAP-ViTs: Task-Adaptive Pruning for On-Device Deployment of Vision Transformers

Add code
Jan 05, 2026
Viaarxiv icon

Generating Storytelling Images with Rich Chains-of-Reasoning

Add code
Dec 08, 2025
Viaarxiv icon

AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption

Add code
May 30, 2025
Figure 1 for AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
Figure 2 for AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
Figure 3 for AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
Figure 4 for AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption
Viaarxiv icon