Picture for Alexander Gasnikov

Alexander Gasnikov

Mathematical methods of reinforcement learning

Add code
Jul 08, 2026
Viaarxiv icon

Wall-Clock Complexity for Zeroth-Order Optimization with Tunable Oracle Fidelity

Add code
May 29, 2026
Viaarxiv icon

Exploring New Frontiers in Vertical Federated Learning: the Role of Saddle Point Reformulation

Add code
Feb 17, 2026
Viaarxiv icon

SCOPE: Smooth Convex Optimization for Planned Evolution of Deformable Linear Objects

Add code
Jan 27, 2026
Viaarxiv icon

Quantum-Inspired Episode Selection for Monte Carlo Reinforcement Learning via QUBO Optimization

Add code
Jan 24, 2026
Viaarxiv icon

Gradient-Free Approaches is a Key to an Efficient Interaction with Markovian Stochasticity

Add code
Jan 03, 2026
Viaarxiv icon

UCB-type Algorithm for Budget-Constrained Expert Learning

Add code
Oct 26, 2025
Viaarxiv icon

Simple Stepsize for Quasi-Newton Methods with Global Convergence Guarantees

Add code
Aug 27, 2025
Viaarxiv icon

AdLoCo: adaptive batching significantly improves communications efficiency and convergence for Large Language Models

Add code
Aug 25, 2025
Viaarxiv icon

KompeteAI: Accelerated Autonomous Multi-Agent System for End-to-End Pipeline Generation for Machine Learning Problems

Add code
Aug 13, 2025
Figure 1 for KompeteAI: Accelerated Autonomous Multi-Agent System for End-to-End Pipeline Generation for Machine Learning Problems
Figure 2 for KompeteAI: Accelerated Autonomous Multi-Agent System for End-to-End Pipeline Generation for Machine Learning Problems
Figure 3 for KompeteAI: Accelerated Autonomous Multi-Agent System for End-to-End Pipeline Generation for Machine Learning Problems
Figure 4 for KompeteAI: Accelerated Autonomous Multi-Agent System for End-to-End Pipeline Generation for Machine Learning Problems
Viaarxiv icon