Picture for Zhangchi Xue

Zhangchi Xue

ToolHazard: Scaling Adversarial Environments for Security Evaluation and Alignment of LLM-based Agents

Add code
Aug 12, 2026
Viaarxiv icon

ToolSafe: Enhancing Tool Invocation Safety of LLM-based agents via Proactive Step-level Guardrail and Feedback

Add code
Jan 15, 2026
Viaarxiv icon