Picture for Jun Huan

Jun Huan

Prism-GRPO: Faster VLA Policy Optimization via Splitting Same-outcome Groups

Add code
Aug 18, 2026
Viaarxiv icon

Consilience for Verifier-Free Test-Time Scaling

Add code
Aug 10, 2026
Viaarxiv icon

NKI-Agent: Domain-Specific Fine-Tuning and Agentic Tool Use for Neuron Kernel Generation

Add code
Jul 05, 2026
Viaarxiv icon

Dissecting model behavior through agent trajectories

Add code
Jun 17, 2026
Viaarxiv icon

ContextWeaver: Selective and Dependency-Structured Memory Construction for LLM Agents

Add code
Apr 24, 2026
Viaarxiv icon

ExecTune: Effective Steering of Black-Box LLMs with Guide Models

Add code
Apr 09, 2026
Viaarxiv icon

MURPHY: Multi-Turn GRPO for Self Correcting Code Generation

Add code
Nov 11, 2025
Viaarxiv icon

Inference Optimization of Foundation Models on AI Accelerators

Add code
Jul 12, 2024
Figure 1 for Inference Optimization of Foundation Models on AI Accelerators
Figure 2 for Inference Optimization of Foundation Models on AI Accelerators
Figure 3 for Inference Optimization of Foundation Models on AI Accelerators
Figure 4 for Inference Optimization of Foundation Models on AI Accelerators
Viaarxiv icon

HLAT: High-quality Large Language Model Pre-trained on AWS Trainium

Add code
Apr 16, 2024
Figure 1 for HLAT: High-quality Large Language Model Pre-trained on AWS Trainium
Figure 2 for HLAT: High-quality Large Language Model Pre-trained on AWS Trainium
Figure 3 for HLAT: High-quality Large Language Model Pre-trained on AWS Trainium
Figure 4 for HLAT: High-quality Large Language Model Pre-trained on AWS Trainium
Viaarxiv icon

Random Walk on Multiple Networks

Add code
Jul 04, 2023
Viaarxiv icon