Picture for Zhiqi Huang

Zhiqi Huang

Kimi K3: Open Frontier Intelligence

Add code
Jul 27, 2026
Viaarxiv icon

PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models

Add code
Jul 27, 2026
Viaarxiv icon

SETA: Scaling Environments for Terminal Agents

Add code
Jul 12, 2026
Viaarxiv icon

TCDA: Thread-Constrained Discourse-Aware Modeling for Conversational Sentiment Quadruple Analysis

Add code
May 03, 2026
Viaarxiv icon

Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models

Add code
Apr 27, 2026
Viaarxiv icon

Kimi K2.5: Visual Agentic Intelligence

Add code
Feb 02, 2026
Viaarxiv icon

WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models

Add code
Jan 28, 2026
Viaarxiv icon

Towards Pixel-Level VLM Perception via Simple Points Prediction

Add code
Jan 27, 2026
Viaarxiv icon

BabyVision: Visual Reasoning Beyond Language

Add code
Jan 10, 2026
Viaarxiv icon

MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models

Add code
Jan 06, 2026
Viaarxiv icon