Picture for Shihan Wang

Shihan Wang

PL-Guard: Probabilistic Logic Reasoning for LLM Guardrails

Add code
Aug 16, 2026
Viaarxiv icon

Safety Training Modulates Harmful Misalignment Under On-Policy RL, But Direction Depends on Environment Design

Add code
Apr 14, 2026
Viaarxiv icon

Neuro-symbolic Action Masking for Deep Reinforcement Learning

Add code
Feb 11, 2026
Viaarxiv icon

Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning

Add code
May 13, 2025
Figure 1 for Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning
Figure 2 for Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning
Figure 3 for Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning
Figure 4 for Credit Assignment and Efficient Exploration based on Influence Scope in Multi-agent Reinforcement Learning
Viaarxiv icon

Short-circuiting Shortcuts: Mechanistic Investigation of Shortcuts in Text Classification

Add code
May 09, 2025
Viaarxiv icon

Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning

Add code
Feb 10, 2025
Figure 1 for Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning
Figure 2 for Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning
Figure 3 for Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning
Figure 4 for Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning
Viaarxiv icon

SHARPIE: A Modular Framework for Reinforcement Learning and Human-AI Interaction Experiments

Add code
Jan 31, 2025
Figure 1 for SHARPIE: A Modular Framework for Reinforcement Learning and Human-AI Interaction Experiments
Figure 2 for SHARPIE: A Modular Framework for Reinforcement Learning and Human-AI Interaction Experiments
Figure 3 for SHARPIE: A Modular Framework for Reinforcement Learning and Human-AI Interaction Experiments
Viaarxiv icon

Non-Progressive Influence Maximization in Dynamic Social Networks

Add code
Dec 10, 2024
Figure 1 for Non-Progressive Influence Maximization in Dynamic Social Networks
Figure 2 for Non-Progressive Influence Maximization in Dynamic Social Networks
Figure 3 for Non-Progressive Influence Maximization in Dynamic Social Networks
Figure 4 for Non-Progressive Influence Maximization in Dynamic Social Networks
Viaarxiv icon

Balancing the Scales: Reinforcement Learning for Fair Classification

Add code
Jul 15, 2024
Figure 1 for Balancing the Scales: Reinforcement Learning for Fair Classification
Figure 2 for Balancing the Scales: Reinforcement Learning for Fair Classification
Figure 3 for Balancing the Scales: Reinforcement Learning for Fair Classification
Figure 4 for Balancing the Scales: Reinforcement Learning for Fair Classification
Viaarxiv icon

Knowledge acquisition for dialogue agents using reinforcement learning on graph representations

Add code
Jun 27, 2024
Viaarxiv icon