Picture for Huiguo He

Huiguo He

JieZi: A Large-Scale Expert-Audited Dataset and Benchmark for Ancient Chinese Character Exegesis

Add code
Aug 12, 2026
Viaarxiv icon

TongGuOCR: A Layout-Aware and Token-Augmented OCR MLLM for Chinese Historical Documents

Add code
Aug 11, 2026
Viaarxiv icon

One Patch Is Enough: Reinforcement-Optimized Visual Token Grounding for MLLM-Based Scene Text Spotting

Add code
Jul 30, 2026
Viaarxiv icon

DiffMath: Symbol- and Graph-Aware Latent Diffusion Transformer for Handwritten Mathematical Expression Generation

Add code
Jun 18, 2026
Viaarxiv icon

ContextDrag: Precise Drag-Based Image Editing via Context-Preserving Token Injection and Position-Consistent Attention

Add code
Dec 09, 2025
Viaarxiv icon

Mod-Adapter: Tuning-Free and Versatile Multi-concept Personalization via Modulation Adapter

Add code
May 24, 2025
Viaarxiv icon

Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention

Add code
Nov 28, 2024
Figure 1 for Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention
Figure 2 for Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention
Figure 3 for Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention
Figure 4 for Improving Multi-Subject Consistency in Open-Domain Image Generation with Isolation and Reposition Attention
Viaarxiv icon

DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion

Add code
Jul 17, 2024
Figure 1 for DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
Figure 2 for DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
Figure 3 for DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
Figure 4 for DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
Viaarxiv icon

MobileVidFactory: Automatic Diffusion-Based Social Media Video Generation for Mobile Devices from Text

Add code
Jul 31, 2023
Figure 1 for MobileVidFactory: Automatic Diffusion-Based Social Media Video Generation for Mobile Devices from Text
Figure 2 for MobileVidFactory: Automatic Diffusion-Based Social Media Video Generation for Mobile Devices from Text
Viaarxiv icon

Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning

Add code
Jun 20, 2023
Figure 1 for Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning
Figure 2 for Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning
Figure 3 for Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning
Figure 4 for Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning
Viaarxiv icon