Picture for Ye Leng

Ye Leng

EchoCoT: Extracting Hidden Chain-of-Thought from Large Reasoning Models

Add code
Aug 20, 2026
Viaarxiv icon

GEO-Flag: Detecting and Measuring GEO-Optimized Web Content

Add code
Aug 17, 2026
Viaarxiv icon

Innocent Panels, Hateful Stories: Evaluating and Detecting Hateful Intent in Multi-Turn Visual Story Generation

Add code
Aug 05, 2026
Viaarxiv icon

When Understanding Becomes a Risk: Authenticity and Safety Risks in the Emerging Image Generation Paradigm

Add code
Mar 25, 2026
Viaarxiv icon

Understanding LLM Behavior When Encountering User-Supplied Harmful Content in Harmless Tasks

Add code
Mar 12, 2026
Viaarxiv icon

Benchmark of Benchmarks: Unpacking Influence and Code Repository Quality in LLM Safety Benchmarks

Add code
Mar 03, 2026
Viaarxiv icon

JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring

Add code
Aug 28, 2025
Viaarxiv icon