Picture for Jihyung Kil

Jihyung Kil

Agentic Context Learning with Self-Discovered Specification

Add code
Jul 09, 2026
Viaarxiv icon

Spinning Straw into Gold: Relabeling LLM Agent Trajectories in Hindsight for Successful Demonstrations

Add code
Jul 05, 2026
Viaarxiv icon

DocPrune:Efficient Document Question Answering via Background, Question, and Comprehension-aware Token Pruning

Add code
Apr 24, 2026
Viaarxiv icon

Anticipatory Planning for Multimodal AI Agents

Add code
Mar 17, 2026
Viaarxiv icon

MiLDEdit: Reasoning-Based Multi-Layer Design Document Editing

Add code
Jan 08, 2026
Viaarxiv icon

Text-Conditioned Background Generation for Editable Multi-Layer Documents

Add code
Dec 19, 2025
Figure 1 for Text-Conditioned Background Generation for Editable Multi-Layer Documents
Figure 2 for Text-Conditioned Background Generation for Editable Multi-Layer Documents
Figure 3 for Text-Conditioned Background Generation for Editable Multi-Layer Documents
Figure 4 for Text-Conditioned Background Generation for Editable Multi-Layer Documents
Viaarxiv icon

VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding

Add code
Aug 10, 2025
Viaarxiv icon

AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models

Add code
Jun 10, 2025
Figure 1 for AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
Figure 2 for AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
Figure 3 for AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
Figure 4 for AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
Viaarxiv icon

CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs

Add code
Jul 23, 2024
Figure 1 for CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
Figure 2 for CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
Figure 3 for CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
Figure 4 for CompBench: A Comparative Reasoning Benchmark for Multimodal LLMs
Viaarxiv icon

ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback

Add code
Jun 25, 2024
Figure 1 for ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
Figure 2 for ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
Figure 3 for ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
Figure 4 for ARES: Alternating Reinforcement Learning and Supervised Fine-Tuning for Enhanced Multi-Modal Chain-of-Thought Reasoning Through Diverse AI Feedback
Viaarxiv icon