Picture for Qiong Tang

Qiong Tang

FARS: A Fully Automated Research System Deployed at Scale

Add code
Jun 30, 2026
Viaarxiv icon

Position Bias Correction is Insufficient for One-Pass Attention Sorting

Add code
Jun 26, 2026
Viaarxiv icon

NLL-Guided Full-Attention Layer Selection for Training-Free Sliding-Window Adaptation

Add code
Jun 26, 2026
Viaarxiv icon

Output-Space Allocation Costs for Calibration-Guided LLM Compression: An Empirical Study

Add code
Jun 26, 2026
Viaarxiv icon

Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition

Add code
Apr 29, 2025
Viaarxiv icon

Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures

Add code
Oct 10, 2024
Figure 1 for Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
Figure 2 for Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
Figure 3 for Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
Figure 4 for Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
Viaarxiv icon

Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT

Add code
Feb 19, 2024
Figure 1 for Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT
Figure 2 for Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT
Figure 3 for Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT
Figure 4 for Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT
Viaarxiv icon

CodeIE: Large Code Generation Models are Better Few-Shot Information Extractors

Add code
May 11, 2023
Viaarxiv icon