Picture for Zebang Cheng

Zebang Cheng

OPD-IAD: From Language Judgment to Industrial Anomaly Detection via On-Policy Self-Distillation

Add code
Jul 21, 2026
Viaarxiv icon

Reflect-R1: Evidence-Driven Reflection for Self-Correction in Long Video Understanding

Add code
Jun 30, 2026
Viaarxiv icon

OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing

Add code
Jun 14, 2026
Viaarxiv icon

EmoTrans: A Benchmark for Understanding, Reasoning, and Predicting Emotion Transitions in Multimodal LLMs

Add code
Apr 25, 2026
Viaarxiv icon

Emotion-LLaMAv2 and MMEVerse: A New Framework and Benchmark for Multimodal Emotion Understanding

Add code
Jan 23, 2026
Viaarxiv icon

Emotion-Qwen: Training Hybrid Experts for Unified Emotion and General Vision-Language Understanding

Add code
May 10, 2025
Viaarxiv icon

Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models

Add code
Apr 10, 2025
Viaarxiv icon

HA-VLN: A Benchmark for Human-Aware Navigation in Discrete-Continuous Environments with Dynamic Multi-Human Interactions, Real-World Validation, and an Open Leaderboard

Add code
Mar 18, 2025
Figure 1 for HA-VLN: A Benchmark for Human-Aware Navigation in Discrete-Continuous Environments with Dynamic Multi-Human Interactions, Real-World Validation, and an Open Leaderboard
Figure 2 for HA-VLN: A Benchmark for Human-Aware Navigation in Discrete-Continuous Environments with Dynamic Multi-Human Interactions, Real-World Validation, and an Open Leaderboard
Figure 3 for HA-VLN: A Benchmark for Human-Aware Navigation in Discrete-Continuous Environments with Dynamic Multi-Human Interactions, Real-World Validation, and an Open Leaderboard
Figure 4 for HA-VLN: A Benchmark for Human-Aware Navigation in Discrete-Continuous Environments with Dynamic Multi-Human Interactions, Real-World Validation, and an Open Leaderboard
Viaarxiv icon

Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model

Add code
Sep 01, 2024
Figure 1 for Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model
Figure 2 for Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model
Figure 3 for Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model
Figure 4 for Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model
Viaarxiv icon

SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition

Add code
Aug 21, 2024
Figure 1 for SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition
Figure 2 for SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition
Figure 3 for SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition
Figure 4 for SZTU-CMU at MER2024: Improving Emotion-LLaMA with Conv-Attention for Multimodal Emotion Recognition
Viaarxiv icon