Picture for Yasheng Sun

Yasheng Sun

CORAL: Learning Amyloid Fibril Ligand Docking with Cooperative Binding Rewards

Add code
Jul 19, 2026
Viaarxiv icon

SciDiagramEdit: Learning to Edit Scientific Diagrams from Paper Revisions

Add code
Jul 16, 2026
Viaarxiv icon

Neural Computers

Add code
Apr 07, 2026
Viaarxiv icon

OneLatent: Single-Token Compression for Visual Latent Reasoning

Add code
Feb 14, 2026
Viaarxiv icon

AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers

Add code
Mar 25, 2025
Figure 1 for AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Figure 2 for AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Figure 3 for AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Figure 4 for AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
Viaarxiv icon

Cosh-DiT: Co-Speech Gesture Video Synthesis via Hybrid Audio-Visual Diffusion Transformers

Add code
Mar 13, 2025
Viaarxiv icon

OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation

Add code
Dec 15, 2024
Figure 1 for OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
Figure 2 for OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
Figure 3 for OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
Figure 4 for OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
Viaarxiv icon

Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction

Add code
Dec 11, 2024
Figure 1 for Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction
Figure 2 for Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction
Figure 3 for Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction
Figure 4 for Hierarchical Context Alignment with Disentangled Geometric and Temporal Modeling for Semantic Occupancy Prediction
Viaarxiv icon

AVI-Talking: Learning Audio-Visual Instructions for Expressive 3D Talking Face Generation

Add code
Feb 25, 2024
Viaarxiv icon

ImageBrush: Learning Visual In-Context Instructions for Exemplar-Based Image Manipulation

Add code
Aug 02, 2023
Figure 1 for ImageBrush: Learning Visual In-Context Instructions for Exemplar-Based Image Manipulation
Figure 2 for ImageBrush: Learning Visual In-Context Instructions for Exemplar-Based Image Manipulation
Figure 3 for ImageBrush: Learning Visual In-Context Instructions for Exemplar-Based Image Manipulation
Figure 4 for ImageBrush: Learning Visual In-Context Instructions for Exemplar-Based Image Manipulation
Viaarxiv icon