P
PaperPicks
Conferences
Doina Precup
McGill University, Montreal, Canada
27 papers at tracked venues · 21 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-4718-9851 ↗
Google Scholar ↗
Homepage ↗
Venues
NeurIPS
×10
ICLR
×6
ICML
×4
AISTATS
×3
AAAI
×1
AAMAS
×1
IJCAI
×1
UAI
×1
Frequent coauthors
Haque Ishfaq
DBLP profile ↗
ORCID search ↗
×3
Harry Zhao
DBLP profile ↗
ORCID search ↗
×2
Sumana Basu
DBLP profile ↗
ORCID search ↗
×1
André Barreto
DBLP profile ↗
ORCID search ↗
×1
Martin Klissarov
DBLP profile ↗
ORCID search ↗
×1
David Abel
DBLP profile ↗
ORCID search ↗
×1
Nazanin Mohammadi Sepahvand
DBLP profile ↗
ORCID search ↗
×1
Marc Lanctot
DBLP profile ↗
ORCID search ↗
×1
Aviral Kumar
DBLP profile ↗
ORCID search ↗
×1
Gavin McCracken
DBLP profile ↗
ORCID search ↗
×1
Arushi Jain
DBLP profile ↗
ORCID search ↗
×1
David Venuto
DBLP profile ↗
ORCID search ↗
×1
Papers
Bootstrapping Personalized Insulin Therapy via Model-Based Reinforcement Learning: An In Silico Study
AAAI 2026
·
Sumana Basu
DBLP profile ↗
ORCID search ↗
Capturing Individual Human Preferences with Reward Features
NeurIPS 2025
·
André Barreto
DBLP profile ↗
ORCID search ↗
Langevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic Learning
ICLR 2025
·
Haque Ishfaq
DBLP profile ↗
ORCID search ↗
MaestroMotif: Skill Design from Artificial Intelligence Feedback
ICLR 2025
·
Martin Klissarov
DBLP profile ↗
ORCID search ↗
Plasticity as the Mirror of Empowerment
NeurIPS 2025
·
David Abel
DBLP profile ↗
ORCID search ↗
Rejecting Hallucinated State Targets during Planning
ICML 2025
·
Harry Zhao
DBLP profile ↗
ORCID search ↗
Selective Unlearning via Representation Erasure Using Domain Adversarial Training
ICLR 2025
·
Nazanin Mohammadi Sepahvand
DBLP profile ↗
ORCID search ↗
Soft Condorcet Optimization for Ranking of General Agents
AAMAS 2025
·
Marc Lanctot
DBLP profile ↗
ORCID search ↗
Training Language Models to Self-Correct via Reinforcement Learning
ICLR 2025
·
Aviral Kumar
DBLP profile ↗
ORCID search ↗
Uncovering a Universal Abstract Algorithm for Modular Addition in Neural Networks
NeurIPS 2025
·
Gavin McCracken
DBLP profile ↗
ORCID search ↗
Adaptive Exploration for Data-Efficient General Value Function Evaluations
NeurIPS 2024
·
Arushi Jain
DBLP profile ↗
ORCID search ↗
Code as Reward: Empowering Reinforcement Learning with VLMs
ICML 2024
·
David Venuto
DBLP profile ↗
ORCID search ↗
Conditions on Preference Relations that Guarantee the Existence of Optimal Policies
AISTATS 2024
·
Jonathan Colaço Carr
DBLP profile ↗
ORCID search ↗
Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
ICLR 2024
·
Harry Zhao
DBLP profile ↗
ORCID search ↗
Discrete Probabilistic Inference as Control in Multi-path Environments
UAI 2024
·
Tristan Deleu
DBLP profile ↗
ORCID search ↗
Efficient Reinforcement Learning by Discovering Neural Pathways
NeurIPS 2024
·
Samin Yeasar Arnob
DBLP profile ↗
ORCID search ↗
Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search
IJCAI 2024
·
Abbas Mehrabian
DBLP profile ↗
ORCID search ↗
Learning Successor Features the Simple Way
NeurIPS 2024
·
Raymond Chua
DBLP profile ↗
ORCID search ↗
Mixtures of Experts Unlock Parameter Scaling for Deep RL
ICML 2024
·
Johan S. Obando-Ceron
DBLP profile ↗
ORCID search ↗
Nash Learning from Human Feedback
ICML 2024
·
Rémi Munos
DBLP profile ↗
ORCID search ↗
Offline Multitask Representation Learning for Reinforcement Learning
NeurIPS 2024
·
Haque Ishfaq
DBLP profile ↗
ORCID search ↗
On learning history-based policies for controlling Markov decision processes
AISTATS 2024
·
Gandharv Patil
DBLP profile ↗
ORCID search ↗
On the Privacy of Selection Mechanisms with Gaussian Noise
AISTATS 2024
·
Jonathan Lebensold
DBLP profile ↗
ORCID search ↗
Parseval Regularization for Continual Reinforcement Learning
NeurIPS 2024
·
Wesley Chung
DBLP profile ↗
ORCID search ↗
Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
ICLR 2024
·
Haque Ishfaq
DBLP profile ↗
ORCID search ↗
QGFN: Controllable Greediness with Action Values
NeurIPS 2024
·
Elaine Lau
DBLP profile ↗
ORCID search ↗
ReactZyme: A Benchmark for Enzyme-Reaction Prediction
NeurIPS 2024
·
Chenqing Hua
DBLP profile ↗
ORCID search ↗