Picture for Aylin Caliskan

Aylin Caliskan

Harness the Memory: A Holistic Evaluation of Memory Substrates in Memory Agents

Add code
Aug 15, 2026
Viaarxiv icon

Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents

Add code
Jul 15, 2026
Viaarxiv icon

RPAM: A Principled Metric for Evaluating Associations in Language Models with High Predictive Validity in Downstream Outputs

Add code
Jul 06, 2026
Viaarxiv icon

Agents' Last Exam

Add code
Jun 03, 2026
Viaarxiv icon

Beyond Cooperative Simulators: Generating Realistic User Personas for Robust Evaluation of LLM Agents

Add code
May 13, 2026
Viaarxiv icon

VEAT Quantifies Implicit Associations in Text-to-Video Generator Sora and Reveals Challenges in Bias Mitigation

Add code
Jan 02, 2026
Viaarxiv icon

Identifying Features Associated with Bias Against 93 Stigmatized Groups in Language Models and Guardrail Model Safety Mitigation

Add code
Dec 22, 2025
Viaarxiv icon

No Thoughts Just AI: Biased LLM Recommendations Limit Human Agency in Resume Screening

Add code
Sep 04, 2025
Viaarxiv icon

Bias Amplification in Stable Diffusion's Representation of Stigma Through Skin Tones and Their Homogeneity

Add code
Aug 24, 2025
Viaarxiv icon

Biases Propagate in Encoder-based Vision-Language Models: A Systematic Analysis From Intrinsic Measures to Zero-shot Retrieval Outcomes

Add code
Jun 06, 2025
Viaarxiv icon