Picture for Jinyi Liu

Jinyi Liu

Prox: Training-Free FFN Activation Sparsity via Approximate Intermediate-Channel Salience in LLMs

Add code
Jul 30, 2026
Viaarxiv icon

The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning

Add code
Jun 28, 2026
Viaarxiv icon

Key Decision-Makers in Multi-Agent Debates: Who Holds the Power?

Add code
Nov 14, 2025
Viaarxiv icon

Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model

Add code
Jul 09, 2025
Figure 1 for Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
Figure 2 for Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
Figure 3 for Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
Figure 4 for Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
Viaarxiv icon

From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation

Add code
May 13, 2025
Figure 1 for From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation
Figure 2 for From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation
Figure 3 for From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation
Figure 4 for From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation
Viaarxiv icon

DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering

Add code
Apr 25, 2025
Figure 1 for DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
Figure 2 for DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
Figure 3 for DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
Figure 4 for DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
Viaarxiv icon

From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models

Add code
Mar 20, 2025
Figure 1 for From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
Figure 2 for From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
Figure 3 for From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
Figure 4 for From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
Viaarxiv icon

CellAgent: An LLM-driven Multi-Agent Framework for Automated Single-cell Data Analysis

Add code
Jul 13, 2024
Viaarxiv icon

vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement

Add code
May 14, 2024
Figure 1 for vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
Figure 2 for vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
Figure 3 for vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
Viaarxiv icon

SheetAgent: A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models

Add code
Mar 06, 2024
Viaarxiv icon