PPaperPicks

Sriparna Saha

Indian Institute of Technology Patna, India

45 papers at tracked venues · 23 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Ask Me Again Differently: GRAS for Measuring Bias in Vision Language Models on Gender, Race, Age, and Skin Tone
  2. BhashaSutra: A Task-Centric Unified Survey of Indian NLP Datasets, Corpora, and Resources
  3. CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
  4. Crossing Borders: A Multimodal Challenge for Indian Poetry Translation and Image Generation
  5. ExpertMix: Aspect and Severity Detection in Conversational Complaints
  6. FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages
  7. From Comments to Conclusions: Adaptive Reader-Aware Summary Generation in Low-Resource Languages via Agent Debate
  8. From Fragments to Facts: A Curriculum-Driven DPO Approach for Generating Hindi News Veracity Explanations
  9. HARPO: Hierarchical Agentic Reasoning for User-Aligned Conversational Recommendation
  10. SUMMIR: A Hallucination-Aware Framework for Ranking Sports Insights from LLMs
  11. Small Models, Big Picture! A Language Model Augmentation for Enhanced Reader-Aware Summarization
  12. Talk, Snap, Complain: Validation-Aware Multimodal Expert Framework for Fine-Grained Customer Grievances
  13. When Background Matters: Breaking Medical Vision Language Models by Transferable Attack
  14. When Meaning Travels: A Granular Lens on Hybrid-MoE's Role in Idiomatic Understanding for Language Models
  15. A Survey of Multilingual Reasoning in Language Models
  16. COSMMIC: Comment-Sensitive Multimodal Multilingual Indian Corpus for Summarization and Headline Generation
  17. DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
  18. Deciphering the Complaint Aspects: Towards an Aspect-Based Complaint Identification Model with Video Complaint Dataset in Finance
  19. Do It Yourself (DIY): Modifying Images for Poems in a Zero-Shot Setting Using Weighted Prompt Manipulation
  20. Fin-Ally: Pioneering the Development of an Advanced, Commonsense-Embedded Conversational AI for Money Matters
  21. From Conversations to Insights: A Multimodal Approach to Discussion Summarization
  22. GASCADE: Grouped Summarization of Adverse Drug Event for Enhanced Cancer Pharmacovigilance
  23. Infogen: Generating Complex Statistical Infographics from Documents
  24. Let's Play Across Cultures: A Large Multilingual, Multicultural Benchmark for Assessing Language Models' Understanding of Sports
  25. M3Retrieve: Benchmarking Multimodal Retrieval for Medicine
  26. PoemTale Diffusion: Minimising Information Loss in Poem to Image Generation with Multi-Stage Prompt Refinement
  27. RELIC: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
  28. Reasoning and Planning for Multimodal Large Language Models: A Multilingual and Cross-Domain Exploration
  29. SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
  30. Text Obsoleteness Detection using Large Language Models
  31. Unlocking Financial Insights: An advanced Multimodal Summarization with Multimodal Output Framework for Financial Advisory Videos
  32. When Words Can't Capture It All: Towards Video-Based User Complaint Text Generation with Multimodal Video Complaint Dataset
  33. A Comprehensive Survey of Hallucination in Large Language, Image, Video and Audio Foundation Models
  34. CLIPSyntel: CLIP and LLM Synergy for Multimodal Question Summarization in Healthcare
  35. Efficacy of Large Language Models in Predicting Hindi Movies' Attributes: A Comprehensive Survey and Content-Based Analysis
  36. Enhancing Adverse Drug Event Detection with Multimodal Dataset: Corpus Creation and Model Development
  37. FedMRL: Data Heterogeneity Aware Federated Multi-agent Deep Reinforcement Learning for Medical Imaging
  38. From Sights to Insights: Towards Summarization of Multimodal Clinical Documents
  39. HealthAlignSumm : Utilizing Alignment for Multimodal Summarization of Code-Mixed Healthcare Dialogues
  40. Hi Model, generating "nice" instead of "good" is not as bad as generating "rice"! Towards Context and Semantic Infused Dialogue Generation Loss Function
  41. MemeGuard: An LLM and VLM-based Framework for Advancing Content Moderation via Meme Intervention
  42. Seeing Beyond Words: Multimodal Aspect-Level Complaint Detection in Ecommerce Videos
  43. Timeline Summarization in the Era of LLMs
  44. ToxVI: a Multimodal LLM-based Framework for Generating Intervention in Toxic Code-Mixed Videos
  45. ToxVidLM: A Multimodal Framework for Toxicity Detection in Code-Mixed Videos