Picture for Kaiqi Yang

Kaiqi Yang

RouteGuard: Certifying Routing Gain in LLM Multi-Agent Systems When Complementarity Is Not Enough

Add code
Aug 05, 2026
Viaarxiv icon

"**Important** You should give me full credits!": Exploring Prompt Injection Attacks on LLM-Based Automatic Grading Systems

Add code
Jun 02, 2026
Viaarxiv icon

Think-Before-Speak: From Internal Evaluation to Public Expression in Multi-Agent Social Simulation

Add code
Jun 02, 2026
Viaarxiv icon

Confusion-Aware Rubric Optimization for LLM-based Automated Grading

Add code
Feb 28, 2026
Viaarxiv icon

Optimizing In-Context Demonstrations for LLM-based Automated Grading

Add code
Feb 28, 2026
Viaarxiv icon

How Uncertain Is the Grade? A Benchmark of Uncertainty Metrics for LLM-Based Automatic Assessment

Add code
Feb 17, 2026
Viaarxiv icon

Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving

Add code
Sep 26, 2025
Viaarxiv icon

LLM-based Automated Grading with Human-in-the-Loop

Add code
Apr 07, 2025
Viaarxiv icon

Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation

Add code
Apr 07, 2025
Figure 1 for Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
Figure 2 for Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
Figure 3 for Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
Figure 4 for Enhancing LLM-Based Short Answer Grading with Retrieval-Augmented Generation
Viaarxiv icon

Unpacking Political Bias in Large Language Models: Insights Across Topic Polarization

Add code
Dec 24, 2024
Figure 1 for Unpacking Political Bias in Large Language Models: Insights Across Topic Polarization
Figure 2 for Unpacking Political Bias in Large Language Models: Insights Across Topic Polarization
Figure 3 for Unpacking Political Bias in Large Language Models: Insights Across Topic Polarization
Viaarxiv icon