Picture for Marian Verhelst

Marian Verhelst

ARES: Adaptive Reasoning-Effort Steering for PPA- and Cost-Aware RTL Optimization with LLM Agents

Add code
Jul 30, 2026
Viaarxiv icon

HiKV: Hierarchical Importance-Aware KV Cache with Hardware Acceleration for LLM Decoding

Add code
Jul 24, 2026
Viaarxiv icon

TreeGRNG: Binary Tree Gaussian Random Number Generator for Efficient Probabilistic AI Hardware

Add code
Jun 15, 2026
Viaarxiv icon

Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads

Add code
Jun 04, 2026
Viaarxiv icon

MONET: Modeling and Optimization of neural NEtwork Training from Edge to Data Centers

Add code
Mar 16, 2026
Viaarxiv icon

P3-LLM: An Integrated NPU-PIM Accelerator for LLM Inference Using Hybrid Numerical Formats

Add code
Nov 16, 2025
Figure 1 for P3-LLM: An Integrated NPU-PIM Accelerator for LLM Inference Using Hybrid Numerical Formats
Figure 2 for P3-LLM: An Integrated NPU-PIM Accelerator for LLM Inference Using Hybrid Numerical Formats
Figure 3 for P3-LLM: An Integrated NPU-PIM Accelerator for LLM Inference Using Hybrid Numerical Formats
Figure 4 for P3-LLM: An Integrated NPU-PIM Accelerator for LLM Inference Using Hybrid Numerical Formats
Viaarxiv icon

Precision-Scalable Microscaling Datapaths with Optimized Reduction Tree for Efficient NPU Integration

Add code
Nov 09, 2025
Viaarxiv icon

An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems

Add code
Aug 20, 2025
Figure 1 for An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems
Figure 2 for An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems
Figure 3 for An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems
Figure 4 for An Open-Source HW-SW Co-Development Framework Enabling Efficient Multi-Accelerator Systems
Viaarxiv icon

Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning

Add code
May 28, 2025
Figure 1 for Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
Figure 2 for Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
Figure 3 for Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
Figure 4 for Efficient Precision-Scalable Hardware for Microscaling (MX) Processing in Robotics Learning
Viaarxiv icon

CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge

Add code
Mar 03, 2025
Figure 1 for CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
Figure 2 for CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
Figure 3 for CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
Figure 4 for CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
Viaarxiv icon