Picture for Xuan Ren

Xuan Ren

Right Answer, Wrong Method: Shortcut Hacking Misleads the Evaluation of LLM Reasoning on Frontier Science Benchmarks

Add code
Aug 03, 2026
Viaarxiv icon

Discovering Millions of Interpretable Features with Sparse Autoencoders

Add code
Jun 25, 2026
Viaarxiv icon

Agentic Proposing: Enhancing Large Language Model Reasoning via Compositional Skill Synthesis

Add code
Feb 03, 2026
Viaarxiv icon

Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs

Add code
Jan 31, 2026
Viaarxiv icon

Efficient Response Generation Method Selection for Fine-Tuning Large Language Models

Add code
Feb 17, 2025
Figure 1 for Efficient Response Generation Method Selection for Fine-Tuning Large Language Models
Figure 2 for Efficient Response Generation Method Selection for Fine-Tuning Large Language Models
Figure 3 for Efficient Response Generation Method Selection for Fine-Tuning Large Language Models
Figure 4 for Efficient Response Generation Method Selection for Fine-Tuning Large Language Models
Viaarxiv icon

I Learn Better If You Speak My Language: Enhancing Large Language Model Fine-Tuning with Style-Aligned Response Adjustments

Add code
Feb 17, 2024
Figure 1 for I Learn Better If You Speak My Language: Enhancing Large Language Model Fine-Tuning with Style-Aligned Response Adjustments
Figure 2 for I Learn Better If You Speak My Language: Enhancing Large Language Model Fine-Tuning with Style-Aligned Response Adjustments
Figure 3 for I Learn Better If You Speak My Language: Enhancing Large Language Model Fine-Tuning with Style-Aligned Response Adjustments
Figure 4 for I Learn Better If You Speak My Language: Enhancing Large Language Model Fine-Tuning with Style-Aligned Response Adjustments
Viaarxiv icon

You Can Generate It Again: Data-to-text Generation with Verification and Correction Prompting

Add code
Jun 28, 2023
Figure 1 for You Can Generate It Again: Data-to-text Generation with Verification and Correction Prompting
Figure 2 for You Can Generate It Again: Data-to-text Generation with Verification and Correction Prompting
Figure 3 for You Can Generate It Again: Data-to-text Generation with Verification and Correction Prompting
Figure 4 for You Can Generate It Again: Data-to-text Generation with Verification and Correction Prompting
Viaarxiv icon

Out-of-Distribution Generalization in Text Classification: Past, Present, and Future

Add code
May 23, 2023
Figure 1 for Out-of-Distribution Generalization in Text Classification: Past, Present, and Future
Figure 2 for Out-of-Distribution Generalization in Text Classification: Past, Present, and Future
Figure 3 for Out-of-Distribution Generalization in Text Classification: Past, Present, and Future
Figure 4 for Out-of-Distribution Generalization in Text Classification: Past, Present, and Future
Viaarxiv icon