Picture for Zixin Chen

Zixin Chen

TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring

Add code
Aug 04, 2026
Viaarxiv icon

AutoSupervision: Closing the Feedback Loop in Scientific Workflows with Grounded Revision Verification

Add code
Jul 30, 2026
Viaarxiv icon

WILDTRACE: Benchmarking Natural Evidence Trails in Long-Context Reasoning

Add code
Jul 10, 2026
Viaarxiv icon

Are Agents Ready to Teach? A Multi-Stage Benchmark for Real-World Teaching Workflows

Add code
May 14, 2026
Viaarxiv icon

VeriLLMed: Interactive Visual Debugging of Medical Large Language Models with Knowledge Graphs

Add code
Apr 25, 2026
Viaarxiv icon

Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering

Add code
Mar 30, 2026
Viaarxiv icon

Towards Comprehensive Stage-wise Benchmarking of Large Language Models in Fact-Checking

Add code
Jan 06, 2026
Viaarxiv icon

VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference

Add code
Dec 21, 2025
Figure 1 for VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
Figure 2 for VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
Figure 3 for VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
Figure 4 for VizDefender: Unmasking Visualization Tampering through Proactive Localization and Intent Inference
Viaarxiv icon

MemeArena: Automating Context-Aware Unbiased Evaluation of Harmfulness Understanding for Multimodal Large Language Models

Add code
Oct 31, 2025
Viaarxiv icon

AdamMeme: Adaptively Probe the Reasoning Capacity of Multimodal Large Language Models on Harmfulness

Add code
Jul 02, 2025
Viaarxiv icon