Picture for Juntao Dai

Juntao Dai

Technical Report on the CVPR 2026@AdvML Workshop Challenge

Add code
Jul 13, 2026
Viaarxiv icon

When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents

Add code
Jun 18, 2026
Viaarxiv icon

SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning

Add code
Jun 01, 2026
Viaarxiv icon

SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence

Add code
Jun 01, 2026
Viaarxiv icon

MiraBench: Evaluating Action-Conditioned Reliability in Robotic World Models

Add code
May 28, 2026
Viaarxiv icon

Stable Reasoning, Unstable Responses: Mitigating LLM Deception via Stability Asymmetry

Add code
Mar 27, 2026
Viaarxiv icon

VISA: Value Injection via Shielded Adaptation for Personalized LLM Alignment

Add code
Mar 05, 2026
Viaarxiv icon

Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment

Add code
Feb 18, 2026
Viaarxiv icon

What, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning

Add code
Feb 09, 2026
Viaarxiv icon

AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security

Add code
Jan 26, 2026
Viaarxiv icon