Picture for Jinhao Duan

Jinhao Duan

HarnessRisk: A Lifecycle-Oriented Benchmark for Agent Harness Safety

Add code
Aug 18, 2026
Viaarxiv icon

Stochastic Meta-Unlearning: Bridging Language Backbone and Multimodal Unlearning

Add code
Jul 21, 2026
Viaarxiv icon

End-to-End Dynamic Sparsity for Resource-Adaptive LLM Inference

Add code
Jun 26, 2026
Viaarxiv icon

Bifocal Diffusion Language Models: Asymmetric Bidirectional Context for Parallel Generation

Add code
Jun 26, 2026
Viaarxiv icon

SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents

Add code
Jun 01, 2026
Viaarxiv icon

IUQ: Interrogative Uncertainty Quantification for Long-Form Large Language Model Generation

Add code
Apr 16, 2026
Viaarxiv icon

A Replicate-and-Quantize Strategy for Plug-and-Play Load Balancing of Sparse Mixture-of-Experts LLMs

Add code
Feb 23, 2026
Viaarxiv icon

LRR-Bench: Left, Right or Rotate? Vision-Language models Still Struggle With Spatial Understanding Tasks

Add code
Jul 27, 2025
Viaarxiv icon

TruthPrInt: Mitigating LVLM Object Hallucination Via Latent Truthful-Guided Pre-Intervention

Add code
Mar 13, 2025
Viaarxiv icon

DynaCode: A Dynamic Complexity-Aware Code Benchmark for Evaluating Large Language Models in Code Generation

Add code
Mar 13, 2025
Viaarxiv icon