PPaperPicks

Aishwarya Agrawal

13 papers at tracked venues · 8 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Assessing and Learning Alignment of Unimodal Vision and Language Models
  2. CTRL-O: Language-Controllable Object-Centric Visual Representation Learning
  3. Controlling Multimodal Llms Via Reward-Guided Decoding
  4. CulturalFrames: Assessing Cultural Expectation Alignment in Text-to-Image Models and Evaluation Metrics
  5. REARANK: Reasoning Re-ranking Agent via Reinforcement Learning
  6. The Promise of RL for Autoregressive Image Editing
  7. UI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction
  8. WebMMU: A Benchmark for Multimodal Multilingual Website Understanding and Code Generation
  9. Benchmarking Vision Language Models for Cultural Understanding
  10. Contrasting Intra-Modal and Ranking Cross-Modal Hard Negatives to Enhance Visio-Linguistic Compositional Understanding
  11. Decompose and Compare Consistency: Measuring VLMs' Answer Reliability via Task-Decomposition Consistency Comparison
  12. Improving Automatic VQA Evaluation Using Large Language Models
  13. VisMin: Visual Minimal-Change Understanding