Picture for Yehui Yang

Yehui Yang

PhysAgent: A Multi-Agent Framework for Reliable Remote Heart Rate Estimation

Add code
Jul 29, 2026
Viaarxiv icon

Hypothesis-Driven Skill Optimization for LLM Agents

Add code
Jun 21, 2026
Viaarxiv icon

FCMBench-Video: Benchmarking Document Video Intelligence

Add code
Apr 28, 2026
Viaarxiv icon

MAT-Cell: A Multi-Agent Tree-Structured Reasoning Framework for Batch-Level Single-Cell Annotation

Add code
Apr 07, 2026
Viaarxiv icon

Revisiting Cross-Attention Mechanisms: Leveraging Beneficial Noise for Domain-Adaptive Learning

Add code
Mar 18, 2026
Viaarxiv icon

FCMBench: A Comprehensive Financial Credit Multimodal Benchmark for Real-world Applications

Add code
Jan 06, 2026
Viaarxiv icon

DATE: Dynamic Absolute Time Enhancement for Long Video Understanding

Add code
Sep 11, 2025
Viaarxiv icon

Towards a Multimodal Large Language Model with Pixel-Level Insight for Biomedicine

Add code
Dec 12, 2024
Viaarxiv icon

A Refer-and-Ground Multimodal Large Language Model for Biomedicine

Add code
Jun 26, 2024
Viaarxiv icon

SegICL: A Universal In-context Learning Framework for Enhanced Segmentation in Medical Imaging

Add code
Apr 02, 2024
Figure 1 for SegICL: A Universal In-context Learning Framework for Enhanced Segmentation in Medical Imaging
Figure 2 for SegICL: A Universal In-context Learning Framework for Enhanced Segmentation in Medical Imaging
Figure 3 for SegICL: A Universal In-context Learning Framework for Enhanced Segmentation in Medical Imaging
Figure 4 for SegICL: A Universal In-context Learning Framework for Enhanced Segmentation in Medical Imaging
Viaarxiv icon