Picture for Jiahao Shao

Jiahao Shao

Native Video-Action Pretraining for Generalizable Robot Control

Add code
Jul 09, 2026
Viaarxiv icon

Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence

Add code
Jul 08, 2026
Viaarxiv icon

Multi-Modal Machine Learning for Breast Cancer Recurrence Prediction

Add code
Jun 01, 2026
Viaarxiv icon

Multi-Task LLM with LoRA Fine-Tuning for Automated Cancer Staging and Biomarker Extraction

Add code
Apr 14, 2026
Viaarxiv icon

The Constant Eye: Benchmarking and Bridging Appearance Robustness in Autonomous Driving

Add code
Feb 13, 2026
Viaarxiv icon

ReRoPE: Repurposing RoPE for Relative Camera Control

Add code
Feb 08, 2026
Viaarxiv icon

ScenDi: 3D-to-2D Scene Diffusion Cascades for Urban Generation

Add code
Jan 21, 2026
Viaarxiv icon

Towards Depth Foundation Model: Recent Trends in Vision-Based Depth Estimation

Add code
Jul 15, 2025
Viaarxiv icon

Prometheus: 3D-Aware Latent Diffusion Models for Feed-Forward Text-to-3D Scene Generation

Add code
Dec 30, 2024
Viaarxiv icon

Learning Temporally Consistent Video Depth from Video Diffusion Priors

Add code
Jun 04, 2024
Viaarxiv icon