PPaperPicks

Doina Precup

McGill University, Montreal, Canada

27 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bootstrapping Personalized Insulin Therapy via Model-Based Reinforcement Learning: An In Silico Study
  2. Capturing Individual Human Preferences with Reward Features
  3. Langevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic Learning
  4. MaestroMotif: Skill Design from Artificial Intelligence Feedback
  5. Plasticity as the Mirror of Empowerment
  6. Rejecting Hallucinated State Targets during Planning
  7. Selective Unlearning via Representation Erasure Using Domain Adversarial Training
    ICLR 2025 ·
    Nazanin Mohammadi Sepahvand
  8. Soft Condorcet Optimization for Ranking of General Agents
  9. Training Language Models to Self-Correct via Reinforcement Learning
  10. Uncovering a Universal Abstract Algorithm for Modular Addition in Neural Networks
  11. Adaptive Exploration for Data-Efficient General Value Function Evaluations
  12. Code as Reward: Empowering Reinforcement Learning with VLMs
  13. Conditions on Preference Relations that Guarantee the Existence of Optimal Policies
  14. Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
  15. Discrete Probabilistic Inference as Control in Multi-path Environments
  16. Efficient Reinforcement Learning by Discovering Neural Pathways
  17. Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search
  18. Learning Successor Features the Simple Way
  19. Mixtures of Experts Unlock Parameter Scaling for Deep RL
  20. Nash Learning from Human Feedback
  21. Offline Multitask Representation Learning for Reinforcement Learning
  22. On learning history-based policies for controlling Markov decision processes
  23. On the Privacy of Selection Mechanisms with Gaussian Noise
  24. Parseval Regularization for Continual Reinforcement Learning
  25. Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
  26. QGFN: Controllable Greediness with Action Values
  27. ReactZyme: A Benchmark for Enzyme-Reaction Prediction