Picture for Samir Sadok

Samir Sadok

HybridCodec: Modeling Discrete and Continuous Representations for Efficient Speech Language Models

Add code
Jun 26, 2026
Viaarxiv icon

Data-Driven Decoding of Russell's Circumplex Model of Affect

Add code
Jun 15, 2026
Viaarxiv icon

From Tokens to Faces: Investigating Discrete Speech Representations for 3D Facial Animation

Add code
Jun 11, 2026
Viaarxiv icon

The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs

Add code
Feb 17, 2026
Viaarxiv icon

Residual Tokens Enhance Masked Autoencoders for Speech Modeling

Add code
Jan 27, 2026
Viaarxiv icon

Bringing Interpretability to Neural Audio Codecs

Add code
Jun 04, 2025
Viaarxiv icon

AnCoGen: Analysis, Control and Generation of Speech with a Masked Autoencoder

Add code
Jan 09, 2025
Viaarxiv icon

A vector quantized masked autoencoder for audiovisual speech emotion recognition

Add code
May 05, 2023
Figure 1 for A vector quantized masked autoencoder for audiovisual speech emotion recognition
Figure 2 for A vector quantized masked autoencoder for audiovisual speech emotion recognition
Figure 3 for A vector quantized masked autoencoder for audiovisual speech emotion recognition
Figure 4 for A vector quantized masked autoencoder for audiovisual speech emotion recognition
Viaarxiv icon

A Multimodal Dynamical Variational Autoencoder for Audiovisual Speech Representation Learning

Add code
May 05, 2023
Viaarxiv icon

A vector quantized masked autoencoder for speech emotion recognition

Add code
Apr 21, 2023
Figure 1 for A vector quantized masked autoencoder for speech emotion recognition
Figure 2 for A vector quantized masked autoencoder for speech emotion recognition
Figure 3 for A vector quantized masked autoencoder for speech emotion recognition
Figure 4 for A vector quantized masked autoencoder for speech emotion recognition
Viaarxiv icon