Picture for Sining Zhoubian

Sining Zhoubian

Memory for Large Language Models

Add code
Jul 28, 2026
Viaarxiv icon

Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

Add code
Jun 20, 2026
Viaarxiv icon

ReST-RL: Achieving Accurate Code Reasoning of LLMs with Optimized Self-Training and Decoding

Add code
Aug 27, 2025
Viaarxiv icon

DataSciBench: An LLM Agent Benchmark for Data Science

Add code
Feb 19, 2025
Figure 1 for DataSciBench: An LLM Agent Benchmark for Data Science
Figure 2 for DataSciBench: An LLM Agent Benchmark for Data Science
Figure 3 for DataSciBench: An LLM Agent Benchmark for Data Science
Figure 4 for DataSciBench: An LLM Agent Benchmark for Data Science
Viaarxiv icon

ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search

Add code
Jun 06, 2024
Figure 1 for ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search
Figure 2 for ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search
Figure 3 for ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search
Figure 4 for ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search
Viaarxiv icon

Rock Classification Based on Residual Networks

Add code
Feb 19, 2024
Viaarxiv icon

SciGLM: Training Scientific Language Models with Self-Reflective Instruction Annotation and Tuning

Add code
Jan 15, 2024
Figure 1 for SciGLM: Training Scientific Language Models with Self-Reflective Instruction Annotation and Tuning
Figure 2 for SciGLM: Training Scientific Language Models with Self-Reflective Instruction Annotation and Tuning
Figure 3 for SciGLM: Training Scientific Language Models with Self-Reflective Instruction Annotation and Tuning
Figure 4 for SciGLM: Training Scientific Language Models with Self-Reflective Instruction Annotation and Tuning
Viaarxiv icon