Picture for Sangmin Lee

Sangmin Lee

Data Intelligence Laboratory, LG AI Research

Rationale-Guided Learning for Multimodal Emotion Recognition

Add code
Aug 11, 2026
Viaarxiv icon

MoLGE: Mixture of Language Group Experts for Efficient Scaling of Massively Multilingual Speech Recognition

Add code
Jul 27, 2026
Viaarxiv icon

SubSplat: High-Resolution Pixel-aligned 3DGS via Sub-pixel Gaussian Reparameterization

Add code
Jul 23, 2026
Viaarxiv icon

AEGIS: Awareness-Enhanced Guidance for Iterative Safeguard

Add code
Jul 20, 2026
Viaarxiv icon

UR-BERT: Scaling Text Encoders for Massively Multilingual TTS Through Universal Romanization and Speech Token Prediction

Add code
Jun 11, 2026
Viaarxiv icon

From Adaptation to Generalization: Adaptive Visual Prompting for Medical Image Segmentation

Add code
Apr 19, 2026
Viaarxiv icon

MuCo: Multi-turn Contrastive Learning for Multimodal Embedding Model

Add code
Feb 06, 2026
Viaarxiv icon

UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching

Add code
Oct 01, 2025
Viaarxiv icon

SAGE-LD: Towards Scalable and Generalizable End-to-End Language Diarization via Simulated Data Augmentation

Add code
Oct 01, 2025
Viaarxiv icon

UniCoM: A Universal Code-Switching Speech Generator

Add code
Aug 21, 2025
Figure 1 for UniCoM: A Universal Code-Switching Speech Generator
Figure 2 for UniCoM: A Universal Code-Switching Speech Generator
Figure 3 for UniCoM: A Universal Code-Switching Speech Generator
Figure 4 for UniCoM: A Universal Code-Switching Speech Generator
Viaarxiv icon