Picture for Hideki Nakayama

Hideki Nakayama

Follow-Your-Preference++: Rethinking Preference Alignment for Image Inpainting

Add code
Jun 02, 2026
Viaarxiv icon

MangaFlow: An End-to-End Agentic Framework for Controllable Story to Manga Generation

Add code
May 27, 2026
Viaarxiv icon

Refining Multidimensional Video Reward Models via Disentangled Influence Functions

Add code
May 27, 2026
Viaarxiv icon

A Comprehensive Information-Decomposition Analysis of Large Vision-Language Models

Add code
Mar 31, 2026
Viaarxiv icon

Post Persona Alignment for Multi-Session Dialogue Generation

Add code
Jun 13, 2025
Figure 1 for Post Persona Alignment for Multi-Session Dialogue Generation
Figure 2 for Post Persona Alignment for Multi-Session Dialogue Generation
Figure 3 for Post Persona Alignment for Multi-Session Dialogue Generation
Figure 4 for Post Persona Alignment for Multi-Session Dialogue Generation
Viaarxiv icon

Exploring and Controlling Diversity in LLM-Agent Conversation

Add code
Dec 30, 2024
Figure 1 for Exploring and Controlling Diversity in LLM-Agent Conversation
Figure 2 for Exploring and Controlling Diversity in LLM-Agent Conversation
Figure 3 for Exploring and Controlling Diversity in LLM-Agent Conversation
Figure 4 for Exploring and Controlling Diversity in LLM-Agent Conversation
Viaarxiv icon

NEMO: Can Multimodal LLMs Identify Attribute-Modified Objects?

Add code
Nov 26, 2024
Viaarxiv icon

BrainCodec: Neural fMRI codec for the decoding of cognitive brain states

Add code
Oct 06, 2024
Figure 1 for BrainCodec: Neural fMRI codec for the decoding of cognitive brain states
Figure 2 for BrainCodec: Neural fMRI codec for the decoding of cognitive brain states
Figure 3 for BrainCodec: Neural fMRI codec for the decoding of cognitive brain states
Figure 4 for BrainCodec: Neural fMRI codec for the decoding of cognitive brain states
Viaarxiv icon

HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis

Add code
Oct 06, 2024
Figure 1 for HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis
Figure 2 for HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis
Figure 3 for HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis
Figure 4 for HALL-E: Hierarchical Neural Codec Language Model for Minute-Long Zero-Shot Text-to-Speech Synthesis
Viaarxiv icon

Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer

Add code
Oct 02, 2024
Figure 1 for Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer
Figure 2 for Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer
Figure 3 for Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer
Figure 4 for Harnessing the Latent Diffusion Model for Training-Free Image Style Transfer
Viaarxiv icon