P
PaperPicks
Conferences
Pradeep Varakantham
21 papers at tracked venues · 15 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0001-7342-5745 ↗
Venues
AAAI
×7
AAMAS
×4
ICLR
×4
NeurIPS
×4
ECAI
×1
NAACL
×1
Frequent coauthors
Huy Hoang
DBLP profile ↗
ORCID search ↗
×3
Jayden Teoh Jing Teoh
DBLP profile ↗
ORCID search ↗
×3
Hao Jiang
DBLP profile ↗
ORCID search ↗
×2
Roman Belaire
DBLP profile ↗
ORCID search ↗
×2
Yuxiao Lu
DBLP profile ↗
ORCID search ↗
×2
Wenjun Li
DBLP profile ↗
ORCID search ↗
×2
Shashank Reddy Chirra
DBLP profile ↗
ORCID search ↗
×2
Changyu Chen
DBLP profile ↗
ORCID search ↗
×1
Sidney Tio
DBLP profile ↗
ORCID search ↗
×1
Dexun Li
DBLP profile ↗
ORCID search ↗
×1
Ze Gong
DBLP profile ↗
ORCID search ↗
×1
Zichang Ge
DBLP profile ↗
ORCID search ↗
×1
Papers
Optimizing Ride-Pooling Operations with Extended Pickup and Drop-Off Flexibility
AAAI 2026
·
Hao Jiang
DBLP profile ↗
ORCID search ↗
Bootstrapping Language Models with DPO Implicit Rewards
ICLR 2025
·
Changyu Chen
DBLP profile ↗
ORCID search ↗
EduQate: Generating Adaptive Curricula through RMABs in Education Settings
AAMAS 2025
·
Sidney Tio
DBLP profile ↗
ORCID search ↗
Marginal Benefit Driven RL Teacher for Unsupervised Environment Design
AAAI 2025
·
Dexun Li
DBLP profile ↗
ORCID search ↗
No Experts, No Problem: Avoidance Learning from Bad Demonstrations
NeurIPS 2025
·
Huy Hoang
DBLP profile ↗
ORCID search ↗
Offline Safe Reinforcement Learning Using Trajectory Classification
AAAI 2025
·
Ze Gong
DBLP profile ↗
ORCID search ↗
On Generalization Across Environments In Multi-Objective Reinforcement Learning
ICLR 2025
·
Jayden Teoh
DBLP profile ↗
ORCID search ↗
On Learning Informative Trajectory Embeddings for Imitation, Classification and Regression
AAMAS 2025
·
Zichang Ge
DBLP profile ↗
ORCID search ↗
On Minimizing Adversarial Counterfactual Error in Adversarial Reinforcement Learning
ICLR 2025
·
Roman Belaire
DBLP profile ↗
ORCID search ↗
Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs
ICLR 2025
·
Yuxiao Lu
DBLP profile ↗
ORCID search ↗
Unlocking the Planning Capabilities of Large Language Models with Maximum Diversity Fine-tuning
NAACL 2025
·
Wenjun Li
DBLP profile ↗
ORCID search ↗
Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning
AAAI 2024
·
Yuxiao Lu
DBLP profile ↗
ORCID search ↗
Imitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning
AAAI 2024
·
Huy Hoang
DBLP profile ↗
ORCID search ↗
Improving Environment Novelty Quantification for Effective Unsupervised Environment Design
NeurIPS 2024
·
Jayden Teoh
DBLP profile ↗
ORCID search ↗
Preserving the Privacy of Reward Functions in MDPs through Deception
ECAI 2024
·
Shashank Reddy Chirra
DBLP profile ↗
ORCID search ↗
Regret-based Defense in Adversarial Reinforcement Learning
AAMAS 2024
·
Roman Belaire
DBLP profile ↗
ORCID search ↗
Reward Penalties on Augmented States for Solving Richly Constrained RL Effectively
AAAI 2024
·
Hao Jiang
DBLP profile ↗
ORCID search ↗
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
NeurIPS 2024
·
Huy Hoang
DBLP profile ↗
ORCID search ↗
Safety through feedback in Constrained RL
NeurIPS 2024
·
Shashank Reddy Chirra
DBLP profile ↗
ORCID search ↗
Unifying Regret and State-Action Space Coverage for Effective Unsupervised Environment Design
AAMAS 2024
·
Jayden Teoh Jing Teoh
DBLP profile ↗
ORCID search ↗
Unsupervised Training Sequence Design: Efficient and Generalizable Agent Training
AAAI 2024
·
Wenjun Li
DBLP profile ↗
ORCID search ↗