Picture for Hanjun Wei

Hanjun Wei

A Learning-Rate-Gated Failure of GRPO in a Small Language and Vision-Language Model Web Agent: A Controlled Null and Its Mechanism

Add code
Jul 14, 2026
Viaarxiv icon

MAG: A Web-Agent Benchmark and Harness for Multimodal Action and Guide Generation

Add code
Jul 14, 2026
Viaarxiv icon

AutoPPA: Automated Circuit PPA Optimization via Contrastive Code-based Rule Library Learning

Add code
Apr 20, 2026
Viaarxiv icon

MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models

Add code
Jul 15, 2024
Figure 1 for MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models
Figure 2 for MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models
Figure 3 for MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models
Figure 4 for MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models
Viaarxiv icon