Picture for Yujun Wang

Yujun Wang

FabriMAE I Trust Myself? Self-Evaluating VLA Action Generation with Markov Attention Entropy

Add code
Aug 17, 2026
Viaarxiv icon

MemWM: Memory-Augmented Text-Based World Model

Add code
Aug 07, 2026
Viaarxiv icon

CausalMix: Data Mixture as Causal Inference for Language Model Training

Add code
Jul 01, 2026
Viaarxiv icon

Beyond Accuracy: Community Perspectives on Machine Translation

Add code
Jun 08, 2026
Viaarxiv icon

EchoRL: Reinforcement Learning via Rollout Echoing

Add code
May 29, 2026
Viaarxiv icon

ASCD: Attention-Steerable Contrastive Decoding for Reducing Hallucination in MLLM

Add code
Jun 17, 2025
Viaarxiv icon

The ICME 2025 Audio Encoder Capability Challenge

Add code
Jan 25, 2025
Viaarxiv icon

Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering

Add code
Dec 16, 2024
Figure 1 for Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
Figure 2 for Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
Figure 3 for Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
Figure 4 for Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
Viaarxiv icon

Optimizing Dysarthria Wake-Up Word Spotting: An End-to-End Approach for SLT 2024 LRDWWS Challenge

Add code
Sep 16, 2024
Viaarxiv icon

Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models

Add code
Sep 04, 2024
Figure 1 for Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
Figure 2 for Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
Figure 3 for Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
Figure 4 for Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
Viaarxiv icon