PPaperPicks

Christopher Pal

Polytechnique Montréal, QC, Canada

25 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
  2. Reducing Hallucinations in Language Model-based SPARQL Query Generation Using Post-Generation Memory Retrieval
  3. StarFlow: Generating Structured Workflow Outputs From Sketch Images
  4. AlignVLM: Bridging Vision and Language Latent Spaces for Multimodal Document Understanding
  5. Beyond FVD: An Enhanced Evaluation Metrics for Video Generation Distribution Quality
  6. CarbonSense: A Multimodal Dataset and Baseline for Carbon Flux Modelling
  7. GeoCoder: Solving Geometry Problems by Generating Modular Code through Vision-Language Models
  8. InsightBench: Evaluating Business Analytics Agents Through Multi-Step Insight Generation
  9. MapBot: A Multi-Modal Agent for Geospatial Analysis
  10. ParetoFlow: Guided Flows in Multi-Objective Optimization
  11. Rendering-Aware Reinforcement Learning for Vector Graphics Generation
  12. Scenario Dreamer: Vectorized Latent Diffusion for Generating Driving Simulation Environments
  13. Seq-VCR: Preventing Collapse in Intermediate Transformer Representations for Enhanced Reasoning
  14. Spatio-Temporal Conditional Diffusion Models for Forecasting Future Multiple Sclerosis Lesion Masks Conditioned on Treatments
  15. StarVector: Generating Scalable Vector Graphics Code from Images and Text
  16. StarVector: Generating Scalable Vector Graphics Code from Images and Text
  17. The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages
  18. The Promise of RL for Autoregressive Image Editing
  19. UI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction
  20. WebMMU: A Benchmark for Multimodal Multilingual Website Understanding and Code Generation
  21. Learning Action and Reasoning-Centric Image Editing from Videos and Simulation
  22. Reinforcement Learning for Blind Stair Climbing with Legged and Wheeled-Legged Robots
  23. RepLiQA: A Question-Answering Dataset for Benchmarking LLMs on Unseen Reference Content
  24. Würstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models
  25. XC-Cache: Cross-Attending to Cached Context for Efficient LLM Inference