PPaperPicks

Shie Mannor

Technion - Israel Institute of Technology, Department of Electrical Engineering, Haifa, Israel

25 papers at tracked venues · 24 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. A Classification View on Meta Learning Bandits
  2. Efficient Fairness-Performance Pareto Front Computation
  3. Global Convergence of Policy Gradient in Average Reward MDPs
  4. Non-rectangular Robust MDPs with Normed Uncertainty Sets
  5. On Bits and Bandits: Quantifying the Regret-Information Trade-off
  6. On the Convergence of Single-Timescale Actor-Critic
  7. Policy Gradient with Tree Expansion
  8. Policy Optimized Text-to-Image Pipeline Design
  9. RL-RC-DoT: A Block-level RL agent for Task-Aware Video Compression
  10. Reinforcement Learning with Segment Feedback
  11. State Entropy Regularization for Robust Reinforcement Learning
  12. Bring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel
  13. Efficient Value Iteration for s-rectangular Robust Markov Decision Processes
  14. Exploration-Driven Policy Optimization in RLHF: Theoretical Insights on Efficient Data Utilization
  15. Improving Token-Based World Models with Parallel Observation Prediction
  16. Learning the Uncertainty Set in Robust Markov Decision Process
  17. PlaMo: Plan and Move in Rich 3D Physical Environments
  18. Policy Gradient for Reinforcement Learning with General Utilities
  19. Policy Gradient with Tree Search (PGTS) in Reinforcement Learning Evades Local Maxima
  20. Prospective Side Information for Latent MDPs
  21. RL in Latent MDPs is Tractable: Online Guarantees via Off-Policy Evaluation
  22. Sobolev Space Regularised Pre Density Models
  23. Solving Non-rectangular Reward-Robust MDPs via Frequency Regularization
  24. Towards Faster Global Convergence of Robust Policy Gradient Methods
  25. Tree Search-Based Policy Optimization under Stochastic Execution Delay