Picture for Sambit Sahu

Sambit Sahu

StreamHear: Domain-Adapted Pseudo-Labeling for Semi-Supervised Streaming Speech Recognition

Add code
Aug 13, 2026
Viaarxiv icon

Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks

Add code
Aug 11, 2026
Viaarxiv icon

Structured Thoughts For Improved Reasoning And Context Pruning

Add code
Jul 11, 2026
Viaarxiv icon

Know When to Stop: Segment-Level Credit Assignment for Reducing Overthinking

Add code
Jul 01, 2026
Viaarxiv icon

SEAD: Competence-Aware On-Policy Distillation via Entropy-Guided Supervision

Add code
Jun 26, 2026
Viaarxiv icon

Ask, Don't Judge: Binary Questions for Interpretable LLM Evaluation and Self-Improvement

Add code
Jun 25, 2026
Viaarxiv icon

SAFARI: Scaling Long Horizon Agentic Fault Attribution via Active Investigation

Add code
Jun 23, 2026
Viaarxiv icon

Towards Scalable Customization and Deployment of Multi-Agent Systems for Enterprise Applications

Add code
Jun 16, 2026
Viaarxiv icon

T1-Bench: Benchmarking Multi-Scenario Agents in Real-World Domains

Add code
Jun 09, 2026
Viaarxiv icon

A History-Aware Visually Grounded Critic for Computer Use Agents

Add code
Jun 09, 2026
Viaarxiv icon