Picture for Chenghao Xiao

Chenghao Xiao

When Tool-Backed Skill Retrieval Fails: Source-Style Collapse in Executable Capability Retrieval

Add code
Aug 17, 2026
Viaarxiv icon

Broken Symmetry in LLM Refusal: Answer Release Is More Local Than Refusal Restoration

Add code
Aug 16, 2026
Viaarxiv icon

Reading Between the Frames: Interpreting Implicit and Non-literal Meaning in Social Media Videos

Add code
Aug 05, 2026
Viaarxiv icon

Understanding the Behaviors of Environment-aware Information Retrieval

Add code
Jun 15, 2026
Viaarxiv icon

MVEB: Massive Video Embedding Benchmark

Add code
Jun 12, 2026
Viaarxiv icon

Translation or Recitation? Calibrating Evaluation Scores for Machine Translation of Extremely Low-Resource Languages

Add code
Mar 26, 2026
Viaarxiv icon

MAEB: Massive Audio Embedding Benchmark

Add code
Feb 17, 2026
Viaarxiv icon

RIGOURATE: Quantifying Scientific Exaggeration with Evidence-Aligned Claim Evaluation

Add code
Jan 07, 2026
Viaarxiv icon

Drivel-ology: Challenging LLMs with Interpreting Nonsense with Depth

Add code
Sep 04, 2025
Figure 1 for Drivel-ology: Challenging LLMs with Interpreting Nonsense with Depth
Figure 2 for Drivel-ology: Challenging LLMs with Interpreting Nonsense with Depth
Figure 3 for Drivel-ology: Challenging LLMs with Interpreting Nonsense with Depth
Figure 4 for Drivel-ology: Challenging LLMs with Interpreting Nonsense with Depth
Viaarxiv icon

VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning

Add code
Jul 30, 2025
Figure 1 for VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
Figure 2 for VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
Figure 3 for VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
Figure 4 for VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
Viaarxiv icon