Picture for Junwei Yang

Junwei Yang

Kimi K3: Open Frontier Intelligence

Add code
Jul 27, 2026
Viaarxiv icon

PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models

Add code
Jul 27, 2026
Viaarxiv icon

Illuminating Unified Multimodal Model for Free-form Interleaved Text-Image Generation

Add code
Jun 29, 2026
Viaarxiv icon

A multi-agent system for spine MRI report generation from multi-sequence imaging

Add code
Jun 08, 2026
Viaarxiv icon

SciCustom: A Framework for Custom Evaluation of Scientific Capabilities in Large Language Models

Add code
May 19, 2026
Viaarxiv icon

Kimi K2.5: Visual Agentic Intelligence

Add code
Feb 02, 2026
Viaarxiv icon

ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement

Add code
Apr 03, 2025
Figure 1 for ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
Figure 2 for ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
Figure 3 for ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
Figure 4 for ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
Viaarxiv icon

Large Language Model Agent: A Survey on Methodology, Applications and Challenges

Add code
Mar 27, 2025
Viaarxiv icon

ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance

Add code
Dec 09, 2024
Viaarxiv icon

SMI-Editor: Edit-based SMILES Language Model with Fragment-level Supervision

Add code
Dec 07, 2024
Figure 1 for SMI-Editor: Edit-based SMILES Language Model with Fragment-level Supervision
Figure 2 for SMI-Editor: Edit-based SMILES Language Model with Fragment-level Supervision
Figure 3 for SMI-Editor: Edit-based SMILES Language Model with Fragment-level Supervision
Figure 4 for SMI-Editor: Edit-based SMILES Language Model with Fragment-level Supervision
Viaarxiv icon