Picture for David Lo

David Lo

Singapore Management University

Second Thought: Reasoning in Parallel as LLM Agents Act and Observe

Add code
Aug 13, 2026
Viaarxiv icon

A Unified Issue Resolution Benchmark for Requirement Clarification, Planning, and Code Generation for Coding Agents

Add code
Aug 10, 2026
Viaarxiv icon

Beyond Text Matching: Towards Reference-Free Evaluation for Human-Oriented Binary Reverse Engineering

Add code
Aug 07, 2026
Viaarxiv icon

Fail-Fast, Restart-Smart: Early Failure Prediction and Restart for SWE Agentic Tasks

Add code
Aug 04, 2026
Viaarxiv icon

Lossless Tensor Compression as Program Synthesis

Add code
Aug 03, 2026
Viaarxiv icon

Graph Is the Verifier: Agentic Reinforcement Learning for Interprocedural Vulnerability Detection

Add code
Jul 29, 2026
Viaarxiv icon

ICAE-Bench: Evaluating Coding Agents as Interactive Project Builders

Add code
Jul 23, 2026
Viaarxiv icon

SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation

Add code
Jul 21, 2026
Viaarxiv icon

How Do Practitioners Build SE Agents? Insights from a Mixed-Methods Study

Add code
Jul 12, 2026
Viaarxiv icon

Are Performance-Optimization Benchmarks Reliably Measuring Coding Agents?

Add code
Jul 01, 2026
Viaarxiv icon