Picture for Manas Gaur

Manas Gaur

University of Maryland, Baltimore County

To Erase, or Not to Erase: Robust Training-Free Concept Erasure with Preservation aware Adaptive Ranked Subspace Expansion

Add code
Jul 26, 2026
Viaarxiv icon

Where do LLMs Fall Short in CBT-Guided Affective Reasoning?

Add code
Jul 03, 2026
Viaarxiv icon

Moral Sensitivity in LLMs: A Tiered Evaluation of Contextual Bias via Behavioral Profiling and Mechanistic Interpretability

Add code
May 04, 2026
Viaarxiv icon

Mechanistic Steering of LLMs Reveals Layer-wise Feature Vulnerabilities in Adversarial Settings

Add code
Apr 25, 2026
Viaarxiv icon

Experiments or Outcomes? Probing Scientific Feasibility in Large Language Models

Add code
Apr 20, 2026
Viaarxiv icon

IMRNNs: An Efficient Method for Interpretable Dense Retrieval via Embedding Modulation

Add code
Jan 27, 2026
Viaarxiv icon

Beyond Memorization: Testing LLM Reasoning on Unseen Theory of Computation Tasks

Add code
Jan 19, 2026
Viaarxiv icon

Neurosymbolic Retrievers for Retrieval-augmented Generation

Add code
Jan 08, 2026
Viaarxiv icon

SymLoc: Symbolic Localization of Hallucination across HaluEval and TruthfulQA

Add code
Nov 18, 2025
Figure 1 for SymLoc: Symbolic Localization of Hallucination across HaluEval and TruthfulQA
Figure 2 for SymLoc: Symbolic Localization of Hallucination across HaluEval and TruthfulQA
Figure 3 for SymLoc: Symbolic Localization of Hallucination across HaluEval and TruthfulQA
Figure 4 for SymLoc: Symbolic Localization of Hallucination across HaluEval and TruthfulQA
Viaarxiv icon

Side Effects of Erasing Concepts from Diffusion Models

Add code
Aug 20, 2025
Figure 1 for Side Effects of Erasing Concepts from Diffusion Models
Figure 2 for Side Effects of Erasing Concepts from Diffusion Models
Figure 3 for Side Effects of Erasing Concepts from Diffusion Models
Figure 4 for Side Effects of Erasing Concepts from Diffusion Models
Viaarxiv icon