P
PaperPicks
Conferences
Alec Koppel
13 papers at tracked venues · 9 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
ICLR
×4
AISTATS
×3
ICML
×3
AAAI
×1
IROS
×1
NeurIPS
×1
Frequent coauthors
Souradip Chakraborty
DBLP profile ↗
ORCID search ↗
×3
Bhrij Patel
DBLP profile ↗
ORCID search ↗
×2
Sihan Zeng
DBLP profile ↗
ORCID search ↗
×2
Jung Yeon Park
DBLP profile ↗
ORCID search ↗
×1
Edwin Lock
DBLP profile ↗
ORCID search ↗
×1
Yuancheng Xu
DBLP profile ↗
ORCID search ↗
×1
Denizalp Goktas
DBLP profile ↗
ORCID search ↗
×1
Aakash Sunil Lahoti
DBLP profile ↗
ORCID search ↗
×1
Papers
Approximate Equivariance in Reinforcement Learning
AISTATS 2025
·
Jung Yeon Park
DBLP profile ↗
ORCID search ↗
Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
ICLR 2025
·
Souradip Chakraborty
DBLP profile ↗
ORCID search ↗
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
IROS 2025
·
Bhrij Patel
DBLP profile ↗
ORCID search ↗
Decentralized Convergence to Equilibrium Prices in Trading Networks
AAAI 2025
·
Edwin Lock
DBLP profile ↗
ORCID search ↗
GenARM: Reward Guided Generation with Autoregressive Reward Model for Test-Time Alignment
ICLR 2025
·
Yuancheng Xu
DBLP profile ↗
ORCID search ↗
Learning in Herding Mean Field Games: Single-Loop Algorithm with Finite-Time Convergence Analysis
AISTATS 2025
·
Sihan Zeng
DBLP profile ↗
ORCID search ↗
Learning in Stackelberg Mean Field Games: A Non-Asymptotic Analysis
NeurIPS 2025
·
Sihan Zeng
DBLP profile ↗
ORCID search ↗
Efficient Inverse Multiagent Learning
ICLR 2024
·
Denizalp Goktas
DBLP profile ↗
ORCID search ↗
Information-Directed Pessimism for Offline Reinforcement Learning
ICML 2024
·
Alec Koppel
MaxMin-RLHF: Alignment with Diverse Human Preferences
ICML 2024
·
Souradip Chakraborty
DBLP profile ↗
ORCID search ↗
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback
ICLR 2024
·
Souradip Chakraborty
DBLP profile ↗
ORCID search ↗
Sharpened Lazy Incremental Quasi-Newton Method
AISTATS 2024
·
Aakash Sunil Lahoti
DBLP profile ↗
ORCID search ↗
Towards Global Optimality for Practical Average Reward Reinforcement Learning without Mixing Time Oracles
ICML 2024
·
Bhrij Patel
DBLP profile ↗
ORCID search ↗