Picture for Ivan Titov

Ivan Titov

Does Out-of-Sight Equal Out-of-Mind in CoT Monitorability?

Add code
Aug 05, 2026
Viaarxiv icon

Consensus as Privileged Context for Label-Free Self-Distillation

Add code
Jul 15, 2026
Viaarxiv icon

Geometric Self-Distillation for Reasoning Generalization

Add code
Jul 07, 2026
Viaarxiv icon

Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models

Add code
May 29, 2026
Viaarxiv icon

Knowledge Offloading: Decomposing LLMs into Sparse Backbones and Memory Modules

Add code
May 27, 2026
Viaarxiv icon

Operationalising the Superficial Alignment Hypothesis via Task Complexity

Add code
Feb 17, 2026
Viaarxiv icon

A Unified View of Attention and Residual Sinks: Outlier-Driven Rescaling is Essential for Transformer Training

Add code
Jan 30, 2026
Viaarxiv icon

Enhancing Long Document Long Form Summarisation with Self-Planning

Add code
Dec 19, 2025
Viaarxiv icon

Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces

Add code
Sep 30, 2025
Figure 1 for Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces
Figure 2 for Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces
Figure 3 for Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces
Figure 4 for Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces
Viaarxiv icon

Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling

Add code
Jul 02, 2025
Viaarxiv icon