Picture for Georgii Aparin

Georgii Aparin

Interpreting and Steering a Text-to-Speech Language Model with Sparse Autoencoders

Add code
Jun 08, 2026
Viaarxiv icon

Optimality of FSQ Tokens for Continuous Diffusion for Categorical Data with Application to Text-to-Speech

Add code
Jun 08, 2026
Viaarxiv icon

Whisper Hallucination Detection and Mitigation via Hidden Representation Steering and Sparse AutoEncoders

Add code
Jun 05, 2026
Viaarxiv icon

A Geometric Account of Activation Steering through Angle-Norm Decomposition

Add code
Jun 04, 2026
Viaarxiv icon

AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders

Add code
Feb 04, 2026
Viaarxiv icon