Picture for Hai Helen Li

Hai Helen Li

From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement

Add code
Jul 26, 2026
Viaarxiv icon

Multi-primitive in-memory computing for Monte Carlo tree search

Add code
Jul 24, 2026
Viaarxiv icon

MUSE: A Run-Centric Platform for Multimodal Unified Safety Evaluation of Large Language Models

Add code
Mar 03, 2026
Viaarxiv icon

PrivAct: Internalizing Contextual Privacy Preservation via Multi-Agent Preference Training

Add code
Feb 14, 2026
Viaarxiv icon

Bridging the Perception Gap: A Lightweight Coarse-to-Fine Architecture for Edge Audio Systems

Add code
Jan 22, 2026
Viaarxiv icon

Voice Evaluation of Reasoning Ability: Diagnosing the Modality-Induced Performance Gap

Add code
Sep 30, 2025
Viaarxiv icon