PPaperPicks

Mayank Vatsa

IIT Jodhpur, India

26 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ACID Test: A Benchmark for Cultural Safety and Alignment in LALMs
  2. Balancing the Scales: Uncertainty-Aware Two-Stage RL for Multiview Child Malnutrition Screening
  3. HumanBench: Two Heads, No Legs, But Mostly Human, the State of Generative Capabilities in T2I Models
  4. NutriScreener: Retrieval Augmented Multi-Pose Graph Attention Network for Malnourishment Screening
  5. Right Looks, Wrong Reasons: Compositional Fidelity in Text-to-Image Generation
    AAAI 2026 · Mayank Vatsa
  6. AQUAFace: Age-Invariant Quality Adaptive Face Recognition for Unconstrained Selfie vs ID Verification
  7. Can Quantized Audio Language Models Perform Zero-Shot Spoofing Detection?
  8. Fine-Grained Erasure in Text-to-Image Diffusion-based Foundation Models
  9. Genμ: The Generative Machine Unlearning Challenge
  10. Harmonizing Geometry and Uncertainty: Diffusion with Hyperspheres
  11. ILLUSION: Unveiling Truth with a Comprehensive Multi-Modal, Multi-Lingual Deepfake Dataset
  12. Learning the Power of "No": Foundation Models with Negations
  13. LitMAS: A Lightweight and Generalized Multi-Modal Anti-Spoofing Framework for Biometric Security
  14. Multimodal Zero-Shot Framework for Deepfake Hate Speech Detection in Low-Resource Languages
  15. Non-invasive TB Detection Using Acoustic and Semantic Features from Cough Sounds
  16. On Adversarial Robustness of Face Presentation Attack Detection Algorithms
  17. SHIELD: A Self-supervised, Silicosis-focused Hierarchical Imaging Framework for Occupational Lung Disease Diagnosis
  18. SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
  19. TAIGen: Training-Free Adversarial Image Generation via Diffusion Models
  20. Words Over Pixels? Rethinking Vision in Multimodal Large Language Models
  21. Adventures of Trustworthy Vision-Language Models: A Survey
    AAAI 2024 · Mayank Vatsa
  22. BirdCollect: A Comprehensive Benchmark for Analyzing Dense Bird Flock Attributes
  23. DomainAdapt: Leveraging Multitask Learning and Domain Insights for Children's Nutritional Status Assessment
  24. HyperSpaceX: Radial and Angular Exploration of HyperSpherical Dimensions
  25. Navigating Text-to-Image Generative Bias Across Indic Languages
  26. ToonerGAN: Reinforcing GANs for Obfuscating Automated Facial Indexing