Picture for Jacob Eisenstein

Jacob Eisenstein

CollabEval: Statistically Efficient Collaborative Model Evaluation via Matrix Completion

Add code
Jul 06, 2026
Viaarxiv icon

Representational Similarity and Model Behavior in Multi-Agent Interaction

Add code
Jun 05, 2026
Viaarxiv icon

Multiple-Prediction-Powered Inference

Add code
Mar 28, 2026
Viaarxiv icon

MT-PingEval: Evaluating Multi-Turn Collaboration with Private Information Games

Add code
Feb 27, 2026
Viaarxiv icon

Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers

Add code
Sep 26, 2025
Figure 1 for Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers
Figure 2 for Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers
Figure 3 for Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers
Figure 4 for Bridging Kolmogorov Complexity and Deep Learning: Asymptotically Optimal Description Length Objectives for Transformers
Viaarxiv icon

Cost-Optimal Active AI Model Evaluation

Add code
Jun 09, 2025
Viaarxiv icon

Don't lie to your friends: Learning what you know from collaborative self-play

Add code
Mar 18, 2025
Viaarxiv icon

InfAlign: Inference-aware language model alignment

Add code
Dec 27, 2024
Viaarxiv icon

ALTA: Compiler-Based Analysis of Transformers

Add code
Oct 23, 2024
Figure 1 for ALTA: Compiler-Based Analysis of Transformers
Figure 2 for ALTA: Compiler-Based Analysis of Transformers
Figure 3 for ALTA: Compiler-Based Analysis of Transformers
Figure 4 for ALTA: Compiler-Based Analysis of Transformers
Viaarxiv icon

Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning

Add code
Oct 10, 2024
Figure 1 for Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
Figure 2 for Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
Figure 3 for Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
Figure 4 for Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning
Viaarxiv icon