PPaperPicks

Sarath Chandar

University of Montreal, Department of Computer Science and Operations Research, Canada

19 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Investigating the Multilingual Calibration Effects of Language Model Instruction Tuning
  2. A Generalist Hanabi Agent
    ICLR 2025 ·
    Arjun Vaithilingam Sudhakar
  3. BindGPT: A Scalable Framework for 3D Molecular Design via Language Modeling and Reinforcement Learning
  4. Combining Domain and Alignment Vectors Provides Better Knowledge-Safety Trade-offs in LLMs
  5. Do Robot Snakes Dream like Electric Sheep? Investigating the Effects of Architectural Inductive Biases on Hallucination
  6. Small Encoders Can Rival Large Decoders in Detecting Groundedness
  7. Tapnext: Tracking Any Point (Tap) as Next Token Prediction
  8. A Deep Dive into the Trade-Offs of Parameter-Efficient Preference Alignment Techniques
  9. Are self-explanations from Large Language Models faithful?
  10. Balancing Context Length and Mixing Times for Reinforcement Learning at Scale
  11. Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language Models
  12. Do Large Language Models Know How Much They Know?
  13. Exploring Quantization for Efficient Pre-Training of Transformer Language Models
  14. Fairness-Aware Structured Pruning in Transformers
  15. Faithfulness Measurable Masked Language Models
  16. Intelligent Switching for Reset-Free RL
  17. Lookbehind-SAM: k steps back, 1 step forward
  18. Mastering Memory Tasks with World Models
  19. Why Don't Prompt-Based Fairness Metrics Correlate?