Picture for Martin Vechev

Martin Vechev

Leveraging Instruction Tuning and Merging for Reasoning Model Adaptation

Add code
Jul 16, 2026
Viaarxiv icon

Generative Compilation: On-the-Fly Compiler Feedback as AI Generates Code

Add code
Jul 15, 2026
Viaarxiv icon

SABER-Math: Automated Benchmark for Information Retrieval Evaluation in Mathematics

Add code
Jun 29, 2026
Viaarxiv icon

TIGER: Inverting Transformer Gradients via Embedding-Subspace Distance Optimization

Add code
Jun 16, 2026
Viaarxiv icon

Optimizing the Cost-Quality Tradeoff of Agentic Theorem Provers in Lean

Add code
Jun 03, 2026
Viaarxiv icon

Learning from Saturated Data: Signals Beyond Correctness for LLM Training

Add code
May 31, 2026
Viaarxiv icon

Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots

Add code
May 28, 2026
Viaarxiv icon

Widening the Gap: Exploiting LLM Quantization via Outlier Injection

Add code
May 14, 2026
Viaarxiv icon

Every Bit, Everywhere, All at Once: A Binomial Multibit LLM Watermark

Add code
May 12, 2026
Viaarxiv icon

Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness

Add code
May 11, 2026
Viaarxiv icon