P
PaperPicks
Conferences
Josiah P. Hanna
12 papers at tracked venues · 8 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
ICML
×4
ICRA
×2
NeurIPS
×2
AAAI
×1
AISTATS
×1
ECCV
×1
ICLR
×1
Frequent coauthors
Adam Labiosa
DBLP profile ↗
ORCID search ↗
×2
Brahma S. Pavse
DBLP profile ↗
ORCID search ↗
×2
Subhojyoti Mukherjee
DBLP profile ↗
ORCID search ↗
×2
Hongyi Zhou
DBLP profile ↗
ORCID search ↗
×1
Arushi Jain
DBLP profile ↗
ORCID search ↗
×1
Abhinav Narayan Harish
DBLP profile ↗
ORCID search ↗
×1
Nicholas Corrado
DBLP profile ↗
ORCID search ↗
×1
Papers
Demystifying the Paradox of Importance Sampling with an Estimated History-Dependent Behavior Policy in Off-Policy Evaluation
ICML 2025
·
Hongyi Zhou
DBLP profile ↗
ORCID search ↗
Multi-Robot Collaboration Through Reinforcement Learning and Abstract Simulation
ICRA 2025
·
Adam Labiosa
DBLP profile ↗
ORCID search ↗
Reinforcement Learning Within the Classical Robotics Stack: A Case Study in Robot Soccer
ICRA 2025
·
Adam Labiosa
DBLP profile ↗
ORCID search ↗
Stable Offline Value Function Learning with Bisimulation-based Representations
ICML 2025
·
Brahma S. Pavse
DBLP profile ↗
ORCID search ↗
When Can Model-Free Reinforcement Learning be Enough for Thinking?
NeurIPS 2025
·
Josiah Hanna
Adaptive Exploration for Data-Efficient General Value Function Evaluations
NeurIPS 2024
·
Arushi Jain
DBLP profile ↗
ORCID search ↗
Learning to Stabilize Online Reinforcement Learning in Unbounded State Spaces
ICML 2024
·
Brahma S. Pavse
DBLP profile ↗
ORCID search ↗
Reinforcement Learning via Auxiliary Task Distillation
ECCV 2024
·
Abhinav Narayan Harish
DBLP profile ↗
ORCID search ↗
SPEED: Experimental Design for Policy Evaluation in Linear Heteroscedastic Bandits
AISTATS 2024
·
Subhojyoti Mukherjee
DBLP profile ↗
ORCID search ↗
SaVeR: Optimal Data Collection Strategy for Safe Policy Evaluation in Tabular MDP
ICML 2024
·
Subhojyoti Mukherjee
DBLP profile ↗
ORCID search ↗
Scaling Offline Evaluation of Reinforcement Learning Agents through Abstraction
AAAI 2024
·
Josiah P. Hanna
Understanding when Dynamics-Invariant Data Augmentations Benefit Model-free Reinforcement Learning Updates
ICLR 2024
·
Nicholas Corrado
DBLP profile ↗
ORCID search ↗