P
PaperPicks
Conferences
Marcello Restelli
23 papers at tracked venues · 16 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-6322-1076 ↗
Google Scholar ↗
Homepage ↗
Venues
NeurIPS
×7
ICML
×6
AISTATS
×3
AAAI
×2
COLT
×2
ECAI
×1
ECML-PKDD
×1
ICLR
×1
Frequent coauthors
Davide Maran
DBLP profile ↗
ORCID search ↗
×6
Alessio Russo
DBLP profile ↗
ORCID search ↗
×2
Riccardo Zamboni
DBLP profile ↗
ORCID search ↗
×2
Marco Mussi
DBLP profile ↗
ORCID search ↗
×2
Riccardo Poiani
DBLP profile ↗
ORCID search ↗
×2
Giovanni Dispoto
DBLP profile ↗
ORCID search ↗
×1
Gianluca Drappo
DBLP profile ↗
ORCID search ↗
×1
Vincenzo De Paola
DBLP profile ↗
ORCID search ↗
×1
Puze Liu
DBLP profile ↗
ORCID search ↗
×1
Francesco Bacchiocchi
DBLP profile ↗
ORCID search ↗
×1
Mirco Mutti
DBLP profile ↗
ORCID search ↗
×1
Gianmarco Genalti
DBLP profile ↗
ORCID search ↗
×1
Papers
Online Market Making and the Value of Observing the Order Book
COLT 2026
·
Davide Maran
DBLP profile ↗
ORCID search ↗
"So, Tell Me About Your Policy...": Distillation of Interpretable Policies from Deep Reinforcement Learning Agents
ECAI 2025
·
Giovanni Dispoto
DBLP profile ↗
ORCID search ↗
Achieving $\widetilde{\mathcal{O}}(\sqrt{T})$ Regret in Average-Reward POMDPs with Known Observation Models
AISTATS 2025
·
Alessio Russo
DBLP profile ↗
ORCID search ↗
Efficient Exploitation of Hierarchical Structure in Sparse Reward Reinforcement Learning
AISTATS 2025
·
Gianluca Drappo
DBLP profile ↗
ORCID search ↗
Enhancing Diversity In Parallel Agents: A Maximum State Entropy Exploration Story
ICML 2025
·
Vincenzo De Paola
DBLP profile ↗
ORCID search ↗
Spectral Learning for Infinite-Horizon Average-Reward POMDPs
NeurIPS 2025
·
Alessio Russo
DBLP profile ↗
ORCID search ↗
Towards Principled Unsupervised Multi-Agent Reinforcement Learning
NeurIPS 2025
·
Riccardo Zamboni
DBLP profile ↗
ORCID search ↗
A Retrospective on the Robot Air Hockey Challenge: Benchmarking Robust, Reliable, and Safe Learning Techniques for Real-world Robotics
NeurIPS 2024
·
Puze Liu
DBLP profile ↗
ORCID search ↗
Autoregressive Bandits
AISTATS 2024
·
Francesco Bacchiocchi
DBLP profile ↗
ORCID search ↗
Bandits with Ranking Feedback
NeurIPS 2024
·
Davide Maran
DBLP profile ↗
ORCID search ↗
Best Arm Identification for Stochastic Rising Bandits
ICML 2024
·
Marco Mussi
DBLP profile ↗
ORCID search ↗
Exploiting Causal Graph Priors with Posterior Sampling for Reinforcement Learning
ICLR 2024
·
Mirco Mutti
DBLP profile ↗
ORCID search ↗
Factored-Reward Bandits with Intermediate Observations
ICML 2024
·
Marco Mussi
DBLP profile ↗
ORCID search ↗
Graph-Triggered Rising Bandits
ICML 2024
·
Gianmarco Genalti
DBLP profile ↗
ORCID search ↗
How to Explore with Belief: State Entropy Maximization in POMDPs
ICML 2024
·
Riccardo Zamboni
DBLP profile ↗
ORCID search ↗
Interpetable Target-Feature Aggregation for Multi-task Learning Based on Bias-Variance Analysis
ECML-PKDD 2024
·
Paolo Bonetti
DBLP profile ↗
ORCID search ↗
Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs
NeurIPS 2024
·
Davide Maran
DBLP profile ↗
ORCID search ↗
No-Regret Reinforcement Learning in Smooth MDPs
ICML 2024
·
Davide Maran
DBLP profile ↗
ORCID search ↗
Online Markov Decision Processes Configuration with Continuous Decision Space
AAAI 2024
·
Davide Maran
DBLP profile ↗
ORCID search ↗
Optimal Multi-Fidelity Best-Arm Identification
NeurIPS 2024
·
Riccardo Poiani
DBLP profile ↗
ORCID search ↗
Parameterized Projected Bellman Operator
AAAI 2024
·
Théo Vincent
DBLP profile ↗
ORCID search ↗
Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs
COLT 2024
·
Davide Maran
DBLP profile ↗
ORCID search ↗
Sub-optimal Experts mitigate Ambiguity in Inverse Reinforcement Learning
NeurIPS 2024
·
Riccardo Poiani
DBLP profile ↗
ORCID search ↗