Picture for Pulkit Verma

Pulkit Verma

Indi-RomCoM: Code-Mixed Benchmark for Evaluating LLMs on Romanized Indic-English Instructions

Add code
Jun 29, 2026
Viaarxiv icon

A Multi Center Breast FNAC Whole-Slide Cytology Dataset for AI-Assisted Patch-Wise Classification Using C1 to C5 Reporting Categories

Add code
Jun 29, 2026
Viaarxiv icon

Discovering and Learning Probabilistic Models of Black-Box AI Capabilities

Add code
Dec 20, 2025
Figure 1 for Discovering and Learning Probabilistic Models of Black-Box AI Capabilities
Figure 2 for Discovering and Learning Probabilistic Models of Black-Box AI Capabilities
Figure 3 for Discovering and Learning Probabilistic Models of Black-Box AI Capabilities
Figure 4 for Discovering and Learning Probabilistic Models of Black-Box AI Capabilities
Viaarxiv icon

AI Planning: A Primer and Survey (Preliminary Report)

Add code
Dec 07, 2024
Figure 1 for AI Planning: A Primer and Survey (Preliminary Report)
Viaarxiv icon

Using Explainable AI and Hierarchical Planning for Outreach with Robots

Add code
Mar 31, 2024
Figure 1 for Using Explainable AI and Hierarchical Planning for Outreach with Robots
Figure 2 for Using Explainable AI and Hierarchical Planning for Outreach with Robots
Figure 3 for Using Explainable AI and Hierarchical Planning for Outreach with Robots
Figure 4 for Using Explainable AI and Hierarchical Planning for Outreach with Robots
Viaarxiv icon

Can LLMs Converse Formally? Automatically Assessing LLMs in Translating and Interpreting Formal Specifications

Add code
Mar 27, 2024
Figure 1 for Can LLMs Converse Formally? Automatically Assessing LLMs in Translating and Interpreting Formal Specifications
Figure 2 for Can LLMs Converse Formally? Automatically Assessing LLMs in Translating and Interpreting Formal Specifications
Figure 3 for Can LLMs Converse Formally? Automatically Assessing LLMs in Translating and Interpreting Formal Specifications
Figure 4 for Can LLMs Converse Formally? Automatically Assessing LLMs in Translating and Interpreting Formal Specifications
Viaarxiv icon

From Reals to Logic and Back: Inventing Symbolic Vocabularies, Actions, and Models for Planning from Raw Data

Add code
Feb 23, 2024
Figure 1 for From Reals to Logic and Back: Inventing Symbolic Vocabularies, Actions, and Models for Planning from Raw Data
Figure 2 for From Reals to Logic and Back: Inventing Symbolic Vocabularies, Actions, and Models for Planning from Raw Data
Figure 3 for From Reals to Logic and Back: Inventing Symbolic Vocabularies, Actions, and Models for Planning from Raw Data
Figure 4 for From Reals to Logic and Back: Inventing Symbolic Vocabularies, Actions, and Models for Planning from Raw Data
Viaarxiv icon

Epistemic Exploration for Generalizable Planning and Learning in Non-Stationary Settings

Add code
Feb 13, 2024
Figure 1 for Epistemic Exploration for Generalizable Planning and Learning in Non-Stationary Settings
Figure 2 for Epistemic Exploration for Generalizable Planning and Learning in Non-Stationary Settings
Viaarxiv icon

Autonomous Capability Assessment of Black-Box Sequential Decision-Making Systems

Add code
Jun 07, 2023
Viaarxiv icon

Benchmarking Generalization via In-Context Instructions on 1,600+ Language Tasks

Add code
Apr 16, 2022
Figure 1 for Benchmarking Generalization via In-Context Instructions on 1,600+ Language Tasks
Figure 2 for Benchmarking Generalization via In-Context Instructions on 1,600+ Language Tasks
Figure 3 for Benchmarking Generalization via In-Context Instructions on 1,600+ Language Tasks
Figure 4 for Benchmarking Generalization via In-Context Instructions on 1,600+ Language Tasks
Viaarxiv icon