Picture for Zhen Yang

Zhen Yang

The University of New South Wales

Calibrating Post-Training Feature Shifts for LLM Data Contamination Detection

Add code
Aug 11, 2026
Viaarxiv icon

MemSIF: From Structured Interactions to Dual-Track Fact Memory for LLM Agents

Add code
Aug 03, 2026
Viaarxiv icon

Conformalized Large Language Models under Configuration Shift

Add code
Aug 02, 2026
Viaarxiv icon

Can Large Language Models Execute Parent Orders?

Add code
Jul 30, 2026
Viaarxiv icon

Kimi K3: Open Frontier Intelligence

Add code
Jul 27, 2026
Viaarxiv icon

MV-Bench: Benchmarking Multimodal Large Language Models for Coordinated Multi-View Interface Construction

Add code
Jul 22, 2026
Viaarxiv icon

Scaling and Stabilizing Large-Scale Embedding-Based Retrieval

Add code
Jul 11, 2026
Viaarxiv icon

Enhancing Video Physical Consistency via Role-aware Joint Training and Modality-decoupled Denoising

Add code
Jul 06, 2026
Viaarxiv icon

scBench-Long: Verifiable Benchmarking of Long-Horizon Single-Cell Biology

Add code
Jun 25, 2026
Viaarxiv icon

LongWebBench: Evaluating Structural and Functional Webpage Generation in Long-Horizon Settings

Add code
Jun 16, 2026
Viaarxiv icon