Picture for Jin Li

Jin Li

Harvard University

CAP: A Scalable Benchmark for Evaluating Cross-Site Browser Agents with Complex Actions and Perception

Add code
Aug 09, 2026
Viaarxiv icon

UniJEPA: A Unified Joint-Embedding Predictive Architecture for Task-Agnostic Visual World Modeling

Add code
Aug 07, 2026
Viaarxiv icon

DiffuseAgent-MI: Distributionally-Grounded,Tool-Integrated Self-Evolving Agents for Faithful Visual Reasoning

Add code
Aug 01, 2026
Viaarxiv icon

Stateful Worlds, Stateless Elasticity: Exact-State Serving for Interactive World Models

Add code
Jul 11, 2026
Viaarxiv icon

DKCD: Domain Knowledge-Enhanced Causal Discovery from Unstructured Data

Add code
Jul 10, 2026
Viaarxiv icon

Automating the Design of Embodied Agent Architectures

Add code
Jul 03, 2026
Viaarxiv icon

Automating the Design of Embodied AgentArchitectures

Add code
Jun 29, 2026
Viaarxiv icon

STEB: A Speech-to-Speech Translation Expressiveness Benchmark for Evaluating Beyond Translation Fidelity

Add code
Jun 24, 2026
Viaarxiv icon

Escaping the KL Agreement Trap in On-Policy Distillation

Add code
Jun 08, 2026
Viaarxiv icon

Independent-Component-Based Encoding Models of Brain Activity During Story Comprehension

Add code
Apr 27, 2026
Viaarxiv icon