Picture for Kaizhen Tan

Kaizhen Tan

New York University, Carnegie Mellon University

Beyond Multimodal Alignment: Certifying Physical Language through Response Substitution and Ordered Execution

Add code
Aug 19, 2026
Viaarxiv icon

Collusion with Competitive Marginals: Price-Level Audits Are Blind by Construction

Add code
Jul 29, 2026
Viaarxiv icon

What Can Latent World Models Know? Physical Parameter Identifiability in Multimodal Predictive Representations

Add code
Jul 29, 2026
Viaarxiv icon

Automorphism-Induced Non-Canonicity in Top-k Explanations of Graph Neural Networks

Add code
Jul 28, 2026
Viaarxiv icon

How Many Bits Can an Adapter Write? Measuring the Capacity and Memorization of Parameter-Efficient Fine-Tuning

Add code
Jul 23, 2026
Viaarxiv icon

GeoFidelity-Bench: Evaluating Segment-Level Geographic Fidelity in Text-to-Image Street-View Generation

Add code
Jun 22, 2026
Viaarxiv icon

CacheWeaver: Cache-Aware Evidence Ordering for Efficient Grounded RAG Inference

Add code
Jun 18, 2026
Viaarxiv icon

Does Visual Token Pruning Improve Calibration? An Empirical Study on Confidence in MLLMs

Add code
Apr 13, 2026
Viaarxiv icon

UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images

Add code
Mar 23, 2026
Viaarxiv icon

CREG: Compass Relational Evidence for Interpreting Spatial Reasoning in Vision-Language Models

Add code
Mar 20, 2026
Viaarxiv icon