Picture for Anmeng Zhang

Anmeng Zhang

Multimodal Reward Hacking in Reinforcement Learning

Add code
Jul 10, 2026
Viaarxiv icon

JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency

Add code
Apr 03, 2026
Viaarxiv icon

SIA: A Synthesize-Inject-Align Framework for Knowledge-Grounded and Secure E-commerce Search LLMs with Industrial Deployment

Add code
Mar 17, 2026
Viaarxiv icon