PPaperPicks

Marcello Restelli

23 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Online Market Making and the Value of Observing the Order Book
  2. "So, Tell Me About Your Policy...": Distillation of Interpretable Policies from Deep Reinforcement Learning Agents
  3. Achieving $\widetilde{\mathcal{O}}(\sqrt{T})$ Regret in Average-Reward POMDPs with Known Observation Models
  4. Efficient Exploitation of Hierarchical Structure in Sparse Reward Reinforcement Learning
  5. Enhancing Diversity In Parallel Agents: A Maximum State Entropy Exploration Story
  6. Spectral Learning for Infinite-Horizon Average-Reward POMDPs
  7. Towards Principled Unsupervised Multi-Agent Reinforcement Learning
  8. A Retrospective on the Robot Air Hockey Challenge: Benchmarking Robust, Reliable, and Safe Learning Techniques for Real-world Robotics
  9. Autoregressive Bandits
  10. Bandits with Ranking Feedback
  11. Best Arm Identification for Stochastic Rising Bandits
  12. Exploiting Causal Graph Priors with Posterior Sampling for Reinforcement Learning
  13. Factored-Reward Bandits with Intermediate Observations
  14. Graph-Triggered Rising Bandits
  15. How to Explore with Belief: State Entropy Maximization in POMDPs
  16. Interpetable Target-Feature Aggregation for Multi-task Learning Based on Bias-Variance Analysis
  17. Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs
  18. No-Regret Reinforcement Learning in Smooth MDPs
  19. Online Markov Decision Processes Configuration with Continuous Decision Space
  20. Optimal Multi-Fidelity Best-Arm Identification
  21. Parameterized Projected Bellman Operator
  22. Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs
  23. Sub-optimal Experts mitigate Ambiguity in Inverse Reinforcement Learning