Picture for Jiahui Geng

Jiahui Geng

Overview of FinMMEval 2026 Task 1: Multilingual Financial Multiple-Choice Question Answering

Add code
Jul 22, 2026
Viaarxiv icon

Overview of FinMMEval 2026 Task 2: Multilingual Financial Short-Answer Question Answering

Add code
Jul 22, 2026
Viaarxiv icon

AI YOU Town: Make Friends and Money with Your Digital Twin

Add code
Jul 12, 2026
Viaarxiv icon

The CLEF-2026 FinMMEval Lab: Multilingual and Multimodal Evaluation of Financial AI Systems

Add code
Feb 11, 2026
Viaarxiv icon

Spurious Rewards Paradox: Mechanistically Understanding How RLVR Activates Memorization Shortcuts in LLMs

Add code
Jan 16, 2026
Viaarxiv icon

Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models

Add code
Jul 16, 2025
Viaarxiv icon

CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation

Add code
May 30, 2025
Figure 1 for CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
Figure 2 for CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
Figure 3 for CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
Figure 4 for CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
Viaarxiv icon

VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration

Add code
May 26, 2025
Figure 1 for VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
Figure 2 for VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
Figure 3 for VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
Figure 4 for VSCBench: Bridging the Gap in Vision-Language Model Safety Calibration
Viaarxiv icon

SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders

Add code
Mar 20, 2025
Figure 1 for SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
Figure 2 for SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
Figure 3 for SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
Figure 4 for SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
Viaarxiv icon

Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI

Add code
Feb 17, 2025
Figure 1 for Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
Figure 2 for Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
Figure 3 for Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
Figure 4 for Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
Viaarxiv icon