Picture for Wang Yang

Wang Yang

Physical AI Governance: From Theory to Practice Across Life Cycle

Add code
Jul 24, 2026
Viaarxiv icon

Mechanistic Diagnostics of Spatial Lexical Bias in Multimodal Large Language Model Spatial Reasoning

Add code
Jun 01, 2026
Viaarxiv icon

AgentCE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments

Add code
Apr 10, 2026
Viaarxiv icon

ACE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments

Add code
Apr 07, 2026
Viaarxiv icon

MOSAIC: Multi-Objective Slice-Aware Iterative Curation for Alignment

Add code
Mar 19, 2026
Viaarxiv icon

Toward Trustworthy Evaluation of Sustainability Rating Methodologies: A Human-AI Collaborative Framework for Benchmark Dataset Construction

Add code
Feb 19, 2026
Viaarxiv icon

When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning

Add code
Feb 01, 2026
Viaarxiv icon

AJAR: Adaptive Jailbreak Architecture for Red-teaming

Add code
Jan 16, 2026
Viaarxiv icon

Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers

Add code
Jan 11, 2026
Viaarxiv icon

Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?

Add code
Oct 14, 2025
Figure 1 for Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
Figure 2 for Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
Figure 3 for Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
Figure 4 for Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
Viaarxiv icon