Picture for Biao Yang

Biao Yang

From Reasoning Depth to Reasoning Breadth: Evaluating Multi-Point Associative Reasoning in Large Language Models

Add code
Aug 12, 2026
Viaarxiv icon

Generative Embedding Benchmark: How Much Information Survives in a Dense Embedding?

Add code
Aug 07, 2026
Viaarxiv icon

LaME: Learning to Think in Latent Space for Multimodal Embedding via Information Bottleneck

Add code
Jun 11, 2026
Viaarxiv icon

OneReason Technical Report

Add code
Jun 04, 2026
Viaarxiv icon

CREM: Compression-Driven Representation Enhancement for Multimodal Retrieval and Comprehension

Add code
Feb 22, 2026
Viaarxiv icon

Compression then Matching: An Efficient Pre-training Paradigm for Multimodal Embedding

Add code
Nov 11, 2025
Viaarxiv icon

Kwai Keye-VL Technical Report

Add code
Jul 02, 2025
Viaarxiv icon

AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing

Add code
Jun 16, 2025
Figure 1 for AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Figure 2 for AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Figure 3 for AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Figure 4 for AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Viaarxiv icon

A 2D Semantic-Aware Position Encoding for Vision Transformers

Add code
May 14, 2025
Figure 1 for A 2D Semantic-Aware Position Encoding for Vision Transformers
Figure 2 for A 2D Semantic-Aware Position Encoding for Vision Transformers
Figure 3 for A 2D Semantic-Aware Position Encoding for Vision Transformers
Figure 4 for A 2D Semantic-Aware Position Encoding for Vision Transformers
Viaarxiv icon

OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning

Add code
Dec 31, 2024
Figure 1 for OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Figure 2 for OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Figure 3 for OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Figure 4 for OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning
Viaarxiv icon