Picture for Yibo Hu

Yibo Hu

TaoLive Digital Avatar Agent Technical Report: Training Agents to Evolve with Their Harness

Add code
Aug 16, 2026
Viaarxiv icon

The Evaluator Is Part of the Experiment: Measuring Open-Ended LLM Conformity

Add code
Aug 05, 2026
Viaarxiv icon

Social Pressure Breaks Majority Voting in LLM Safety Panels

Add code
Aug 05, 2026
Viaarxiv icon

Subtype Robustness Is Not Just Accuracy: Calibration Under Unseen Subtype Shift

Add code
Aug 02, 2026
Viaarxiv icon

Early Detection of Distributed Backdoors in Multi-Agent LLM Systems: A Characterization Study

Add code
Jul 27, 2026
Viaarxiv icon

OmniScope: Modality-Decoupled Token Compression for Omnimodal Large Language Models

Add code
Jul 25, 2026
Viaarxiv icon

When Local Monitors Miss Compositional Harm: Diagnosing Distributed Backdoors in Multi-Agent Systems

Add code
Jul 13, 2026
Viaarxiv icon

Most LLM Conformity Needs No Speaker: Measuring the Speaker-Free Floor in Peer-Pressure Benchmarks

Add code
Jul 06, 2026
Viaarxiv icon

When Better Codebooks Are Not Enough: Predictive Performance and Behavioral Reliability in LLM Political Event Coding

Add code
Jun 04, 2026
Viaarxiv icon

Can I Take Another Dose? Evaluating LLM Decision-Making Under Temporal Uncertainty in OTC Dosing QA

Add code
Jun 02, 2026
Viaarxiv icon