Picture for Feng Tian

Feng Tian

Jack

Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control

Add code
Aug 03, 2026
Viaarxiv icon

Enfold: Folding World-Generator Computation into Predictive Representations for Efficient Embodied Control

Add code
Jul 29, 2026
Viaarxiv icon

Joint Text-Audio Alignment for EEG-to-Text Decoding in Chinese Speech Production and Perception

Add code
Jul 28, 2026
Viaarxiv icon

CLAP: Closed-Loop Training, Evaluation, and Release Control for Domain Agent Post-training

Add code
Jul 02, 2026
Viaarxiv icon

CoMo3R-SLAM: Collaborative Monocular Dense SLAM with Learned 3D Reconstruction Priors for Outdoor Multi-Agent Systems

Add code
May 28, 2026
Viaarxiv icon

StepAudio 2.5 Technical Report

Add code
May 22, 2026
Viaarxiv icon

HFP-SAM: Hierarchical Frequency Prompted SAM for Efficient Marine Animal Segmentation

Add code
Mar 13, 2026
Viaarxiv icon

DMESR: Dual-view MLLM-based Enhancing Framework for Multimodal Sequential Recommendation

Add code
Feb 14, 2026
Viaarxiv icon

Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion

Add code
Feb 04, 2026
Viaarxiv icon

Training LLMs with Fault Tolerant HSDP on 100,000 GPUs

Add code
Jan 30, 2026
Viaarxiv icon