Picture for Yiqian Zhang

Yiqian Zhang

Can Text-to-Image Models Draw from the Right Frame of Reference?

Add code
Aug 04, 2026
Viaarxiv icon

Test-Time Curriculum for Open-Set AIGC Detection

Add code
Aug 01, 2026
Viaarxiv icon

CLEAR: Unlocking Generative Potential for Degraded Image Understanding in Unified Multimodal Models

Add code
Apr 06, 2026
Viaarxiv icon

WirelessBench: A Tolerance-Aware LLM Agent Benchmark for Wireless Network Intelligence

Add code
Mar 22, 2026
Viaarxiv icon

RoboPaint: From Human Demonstration to Any Robot and Any View

Add code
Feb 05, 2026
Viaarxiv icon

Reasoning While Asking: Transforming Reasoning Large Language Models from Passive Solvers to Proactive Inquirers

Add code
Jan 29, 2026
Viaarxiv icon

OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing

Add code
Aug 12, 2025
Figure 1 for OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing
Figure 2 for OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing
Figure 3 for OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing
Figure 4 for OmniVTLA: Vision-Tactile-Language-Action Model with Semantic-Aligned Tactile Sensing
Viaarxiv icon