P
PaperPicks
Conferences
Debmalya Mandal
15 papers at tracked venues · 9 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
AISTATS
×5
NeurIPS
×5
ICML
×2
AAAI
×1
UAI
×1
WWW
×1
Frequent coauthors
Andi Nika
DBLP profile ↗
ORCID search ↗
×3
Hadi Hosseini
DBLP profile ↗
ORCID search ↗
×2
Nam Phuong Tran
DBLP profile ↗
ORCID search ↗
×2
Rilind Sahitaj
DBLP profile ↗
ORCID search ↗
×1
Vasilis Pollatos
DBLP profile ↗
ORCID search ↗
×1
Jiarui Gan
DBLP profile ↗
ORCID search ↗
×1
Thomas Kleine Buening
DBLP profile ↗
ORCID search ↗
×1
Stelios Triantafyllou
DBLP profile ↗
ORCID search ↗
×1
Ben Rank
DBLP profile ↗
ORCID search ↗
×1
Papers
Corruption Robust Offline Reinforcement Learning with Human Feedback
AISTATS 2025
·
Debmalya Mandal
Independent Learning in Performative Markov Potential Games
AISTATS 2025
·
Rilind Sahitaj
DBLP profile ↗
ORCID search ↗
On Corruption-Robustness in Performative Reinforcement Learning
AAAI 2025
·
Vasilis Pollatos
DBLP profile ↗
ORCID search ↗
Performative Reinforcement Learning with Linear Markov Decision Process
AISTATS 2025
·
Debmalya Mandal
Policy Teaching via Data Poisoning in Learning from Human Preferences
AISTATS 2025
·
Andi Nika
DBLP profile ↗
ORCID search ↗
Stochastic Principal-Agent Problems: Computing and Learning Optimal History-Dependent Policies
NeurIPS 2025
·
Jiarui Gan
DBLP profile ↗
ORCID search ↗
Strategyproof Reinforcement Learning from Human Feedback
NeurIPS 2025
·
Thomas Kleine Buening
DBLP profile ↗
ORCID search ↗
Surprisingly Popular Voting with Concentric Rank-Order Models
WWW 2025
·
Hadi Hosseini
DBLP profile ↗
ORCID search ↗
Agent-Specific Effects: A Causal Effect Propagation Analysis in Multi-Agent MDPs
ICML 2024
·
Stelios Triantafyllou
DBLP profile ↗
ORCID search ↗
Corruption-Robust Offline Two-Player Zero-Sum Markov Games
AISTATS 2024
·
Andi Nika
DBLP profile ↗
ORCID search ↗
Learning the Expected Core of Strictly Convex Stochastic Cooperative Games
NeurIPS 2024
·
Nam Phuong Tran
DBLP profile ↗
ORCID search ↗
Performative Reinforcement Learning in Gradually Shifting Environments
UAI 2024
·
Ben Rank
DBLP profile ↗
ORCID search ↗
Reward Model Learning vs. Direct Policy Optimization: A Comparative Analysis of Learning from Human Preferences
ICML 2024
·
Andi Nika
DBLP profile ↗
ORCID search ↗
Symmetric Linear Bandits with Hidden Symmetry
NeurIPS 2024
·
Nam Phuong Tran
DBLP profile ↗
ORCID search ↗
The Surprising Effectiveness of SP Voting with Partial Preferences
NeurIPS 2024
·
Hadi Hosseini
DBLP profile ↗
ORCID search ↗