PPaperPicks

Adish Singla

Max Planck Institute for Software Systems, Germany

16 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. TURTLEAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics
  2. Corruption Robust Offline Reinforcement Learning with Human Feedback
  3. Curriculum Design for Trajectory-Constrained Agent: Compressing Chain-of-Thought Tokens in LLMs
  4. Formal Models of Active Learning from Contrastive Examples
  5. Inference-Time Personalized Alignment with a Few User Preference Queries
  6. Policy Teaching via Data Poisoning in Learning from Human Preferences
  7. Program Synthesis Benchmark for Visual Programming in XLogoOnline Environment
  8. Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints
  9. Benchmarking Generative Models on Computational Thinking Tests in Elementary Visual Programming
  10. Corruption-Robust Offline Two-Player Zero-Sum Markov Games
  11. Hints-In-Browser: Benchmarking Language Models for Programming Feedback Generation
  12. Informativeness of Reward Functions in Reinforcement Learning
  13. Learning Embeddings for Sequential Tasks Using Population of Agents
  14. On the Complexity of Teaching a Family of Linear Behavior Cloning Learners
  15. Proximal Curriculum with Task Correlations for Deep Reinforcement Learning
  16. Reward Model Learning vs. Direct Policy Optimization: A Comparative Analysis of Learning from Human Preferences