Picture for Ke Hu

Ke Hu

VoiceChat-TTS: A Low-Latency Continuous Speech Synthesis Model for Interactive Agents

Add code
Aug 13, 2026
Viaarxiv icon

Steering Generative Reinforcement Learning into Stable Robotic Controller

Add code
Jun 15, 2026
Viaarxiv icon

GenPO++: Generative Policy Optimization with Jacobian-free Likelihood Ratios

Add code
Jun 05, 2026
Viaarxiv icon

Sample-Efficient Diffusion-based Reinforcement Learning with Critic Guidance

Add code
May 28, 2026
Viaarxiv icon

FedTopo: Topology-Informed Representation Alignment in Federated Learning under Non-I.I.D. Conditions

Add code
Nov 16, 2025
Viaarxiv icon

GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning

Add code
May 24, 2025
Figure 1 for GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
Figure 2 for GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
Figure 3 for GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
Figure 4 for GenPO: Generative Diffusion Models Meet On-Policy Reinforcement Learning
Viaarxiv icon

Word Level Timestamp Generation for Automatic Speech Recognition and Translation

Add code
May 21, 2025
Figure 1 for Word Level Timestamp Generation for Automatic Speech Recognition and Translation
Figure 2 for Word Level Timestamp Generation for Automatic Speech Recognition and Translation
Figure 3 for Word Level Timestamp Generation for Automatic Speech Recognition and Translation
Viaarxiv icon

Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model

Add code
May 21, 2025
Figure 1 for Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model
Figure 2 for Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model
Figure 3 for Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model
Figure 4 for Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model
Viaarxiv icon

Training and Inference Efficiency of Encoder-Decoder Speech Models

Add code
Mar 07, 2025
Figure 1 for Training and Inference Efficiency of Encoder-Decoder Speech Models
Figure 2 for Training and Inference Efficiency of Encoder-Decoder Speech Models
Figure 3 for Training and Inference Efficiency of Encoder-Decoder Speech Models
Figure 4 for Training and Inference Efficiency of Encoder-Decoder Speech Models
Viaarxiv icon

NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts

Add code
Nov 08, 2024
Figure 1 for NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts
Figure 2 for NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts
Figure 3 for NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts
Figure 4 for NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts
Viaarxiv icon