Picture for Ankur Samanta

Ankur Samanta

Frustratingly Simple Black-Box Adaptation of Language Models via Logit Bias

Add code
Jul 24, 2026
Viaarxiv icon

Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information

Add code
Jul 21, 2026
Viaarxiv icon

BayesBench: Evaluating LLM Belief Trajectories Under Multi-Turn Evidence Accumulation

Add code
Jun 29, 2026
Viaarxiv icon

Credit Assignment with Resets in Language Model Reasoning

Add code
May 26, 2026
Viaarxiv icon

Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale

Add code
May 20, 2026
Viaarxiv icon

Gaze patterns predict preference and confidence in pairwise AI image evaluation

Add code
Mar 25, 2026
Viaarxiv icon

Structure Enables Effective Self-Localization of Errors in LLMs

Add code
Feb 02, 2026
Viaarxiv icon

Imbalanced Gradients in RL Post-Training of Multi-Task LLMs

Add code
Oct 22, 2025
Viaarxiv icon

Internalizing Self-Consistency in Language Models: Multi-Agent Consensus Alignment

Add code
Sep 18, 2025
Figure 1 for Internalizing Self-Consistency in Language Models: Multi-Agent Consensus Alignment
Figure 2 for Internalizing Self-Consistency in Language Models: Multi-Agent Consensus Alignment
Figure 3 for Internalizing Self-Consistency in Language Models: Multi-Agent Consensus Alignment
Figure 4 for Internalizing Self-Consistency in Language Models: Multi-Agent Consensus Alignment
Viaarxiv icon

FragmentNet: Adaptive Graph Fragmentation for Graph-to-Sequence Molecular Representation Learning

Add code
Feb 03, 2025
Figure 1 for FragmentNet: Adaptive Graph Fragmentation for Graph-to-Sequence Molecular Representation Learning
Figure 2 for FragmentNet: Adaptive Graph Fragmentation for Graph-to-Sequence Molecular Representation Learning
Figure 3 for FragmentNet: Adaptive Graph Fragmentation for Graph-to-Sequence Molecular Representation Learning
Figure 4 for FragmentNet: Adaptive Graph Fragmentation for Graph-to-Sequence Molecular Representation Learning
Viaarxiv icon