Picture for Ilija Bogunovic

Ilija Bogunovic

Meta-Learning Preferences for Multilingual LLM Alignment

Add code
Jul 14, 2026
Viaarxiv icon

SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

Add code
Jun 30, 2026
Viaarxiv icon

Re-evaluating Confidence Remasking in Masked Diffusion Language Models

Add code
Jun 10, 2026
Viaarxiv icon

GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models

Add code
May 28, 2026
Viaarxiv icon

Overton Pluralistic Reinforcement Learning for Large Language Models

Add code
Feb 24, 2026
Viaarxiv icon

LLM-WikiRace: Benchmarking Long-term Planning and Reasoning over Real-World Knowledge Graphs

Add code
Feb 18, 2026
Viaarxiv icon

Multi-Task GRPO: Reliable LLM Reasoning Across Tasks

Add code
Feb 05, 2026
Viaarxiv icon

Robust Bayesian Optimisation with Unbounded Corruptions

Add code
Nov 19, 2025
Viaarxiv icon

Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data

Add code
Aug 17, 2025
Figure 1 for Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
Figure 2 for Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
Figure 3 for Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
Figure 4 for Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
Viaarxiv icon

Robust Multi-Objective Controlled Decoding of Large Language Models

Add code
Mar 11, 2025
Figure 1 for Robust Multi-Objective Controlled Decoding of Large Language Models
Figure 2 for Robust Multi-Objective Controlled Decoding of Large Language Models
Figure 3 for Robust Multi-Objective Controlled Decoding of Large Language Models
Figure 4 for Robust Multi-Objective Controlled Decoding of Large Language Models
Viaarxiv icon