Picture for Kaishen Yuan

Kaishen Yuan

When Efficiency Becomes Fragility: Exploiting Dynamic Routing Vulnerabilities in Adaptive UAV Tracking

Add code
Aug 04, 2026
Viaarxiv icon

CraftAlign: Feature-Grounded Evaluation and Revision Guidance for AI Stories

Add code
Aug 02, 2026
Viaarxiv icon

MemoGen: Can Past Experience Improve Future Text-to-Image Generation?

Add code
Jun 02, 2026
Viaarxiv icon

$Z^2$-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models

Add code
Apr 26, 2026
Viaarxiv icon

$Δ$VLA: Prior-Guided Vision-Language-Action Models via World Knowledge Variation

Add code
Mar 09, 2026
Viaarxiv icon

AULLM++: Structural Reasoning with Large Language Models for Micro-Expression Recognition

Add code
Mar 09, 2026
Viaarxiv icon

AU-LLM: Micro-Expression Action Unit Detection via Enhanced LLM-Based Feature Fusion

Add code
Jul 29, 2025
Viaarxiv icon

Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model

Add code
May 30, 2025
Figure 1 for Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
Figure 2 for Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
Figure 3 for Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
Figure 4 for Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
Viaarxiv icon

FEALLM: Advancing Facial Emotion Analysis in Multimodal Large Language Models with Emotional Synergy and Reasoning

Add code
May 19, 2025
Viaarxiv icon

AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection

Add code
Mar 30, 2025
Figure 1 for AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection
Figure 2 for AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection
Figure 3 for AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection
Figure 4 for AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection
Viaarxiv icon