PPaperPicks

Milind Tambe

Harvard University, Cambridge, MA, USA

35 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Generative AI Against Poaching: Latent Composite Flow Matching for Poaching Prediction
  2. Optimizing Health Coverage in Ethiopia: A Learning-augmented Approach and Persistent Proportionality Under an Online Budget
  3. Preference Robustness for DPO with Applications to Public Health
  4. VORTEX: Aligning Task Utility and Human Preferences Through LLM-Guided Reward Shaping
  5. Adaptive Frontier Exploration on Graphs with Applications to Network-Based Disease Testing
  6. Bayesian Collaborative Bandits with Thompson Sampling for Improved Outreach in Maternal Health
  7. Beyond Listenership: AI-Predicted Interventions Drive Improvements in Maternal Health Behaviours
  8. Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data
  9. Context in Public Health for Underserved Communities: A Bayesian Approach to Online Restless Bandits
  10. Evaluating Index-based Treatment Allocation in Underresourced Communities
  11. Finite-Horizon Single-Pull Restless Bandits: An Efficient Index Policy For Scarce Resource Allocation
  12. Navigating the Social Welfare Frontier: Portfolios for Multi-objective Reinforcement Learning
  13. On Diffusion Models for Multi-Agent Partial Observability: Shared Attractors, Error Bounds, and Composite Flow
  14. Optimizing Vital Sign Monitoring in Resource-Constrained Maternal Care: An RL-Based Restless Bandit Approach
  15. PRIORITY2REWARD: Incorporating Healthworker Preferences for Resource Allocation Planning
  16. Reinforcement learning with combinatorial actions for coupled restless bandits
  17. Robust Optimization with Diffusion Models for Green Security
  18. The Bandit Whisperer: Communication Learning for Restless Bandits
  19. Towards Foundation-model-based Multiagent System to Accelerate AI for Social Impact
  20. What is the Right Notion of Distance between Predict-then-Optimize Tasks?
  21. A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
  22. Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
  23. Efficient Public Health Intervention Planning Using Decomposition-Based Decision-focused Learning
  24. Escape Sensing Games: Detection-vs-Evasion in Security Applications
  25. Group Fairness in Predict-Then-Optimize Settings for Restless Bandits
  26. Improving Health Information Access in the World's Largest Maternal Mobile Health Program via Bandit Algorithms
  27. Improving Mobile Maternal and Child Health Care Programs: Collaborative Bandits for Time Slot Selection
  28. Leaving the Nest: Going beyond Local Loss Functions for Predict-Then-Optimize
  29. Position: Application-Driven Innovation in Machine Learning
  30. Position: Social Environment Design Should be Further Developed for AI-based Policy-Making
  31. Toward Computationally Efficient Inverse Reinforcement Learning via Reward Shaping
  32. Towards Fairness constrained Restless Multi-Armed Bandits: a Case Study of Maternal and child Care Domain
  33. Towards Zero Shot Learning in Restless Multi-armed Bandits
  34. Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
  35. Transcendence: Generative Models Can Outperform The Experts That Train Them