Picture for Yitong Zhang

Yitong Zhang

Benchmarking the Robustness of Autonomous Driving to Environmental Illusions: A Lane Perception Perspective

Add code
Jul 07, 2026
Viaarxiv icon

CoACT: Action-Preserving Observation Compression for Coding Agents

Add code
Jul 03, 2026
Viaarxiv icon

Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

Add code
Jun 10, 2026
Viaarxiv icon

DV-World: Benchmarking Data Visualization Agents in Real-World Scenarios

Add code
Apr 28, 2026
Viaarxiv icon

To See is Not to Master: Teaching LLMs to Use Private Libraries for Code Generation

Add code
Mar 17, 2026
Viaarxiv icon

What Papers Don't Tell You: Recovering Tacit Knowledge for Automated Paper Reproduction

Add code
Mar 02, 2026
Viaarxiv icon

Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

Add code
Feb 11, 2026
Viaarxiv icon

Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment

Add code
Feb 10, 2026
Viaarxiv icon

The Mask of Civility: Benchmarking Chinese Mock Politeness Comprehension in Large Language Models

Add code
Feb 03, 2026
Viaarxiv icon

Lookahead-then-Verify: Reliable Constrained Decoding for Diffusion LLMs under Context-Free Grammars

Add code
Jan 31, 2026
Viaarxiv icon