Picture for Xinqi Yang

Xinqi Yang

SafeSceneReason: A Multimodal Reasoning Benchmark Connecting Industrial Hazards with Accident Knowledge

Add code
Aug 10, 2026
Viaarxiv icon

MMArch: Benchmarking Multimodal Reasoning Grounded in Architectural Evidence

Add code
Aug 10, 2026
Viaarxiv icon

CircuitReason-1k: Benchmarking Long-Horizon Visual-to-Symbolic Reasoning inElectrical Circuits

Add code
Aug 10, 2026
Viaarxiv icon

Evaluating Large Language Models on Financial Report Summarization: An Empirical Study

Add code
Nov 11, 2024
Figure 1 for Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
Figure 2 for Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
Figure 3 for Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
Figure 4 for Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
Viaarxiv icon