PPaperPicks

Siwen Luo

7 papers at tracked venues · 5 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Survey on MLLM-based Visually Rich Document Understanding: Methods, Challenges, and Emerging Trends
  2. Docs2Synth: A Synthetic Data Tuned Retriever Framework for Documents Understanding
  3. 'No' Matters: Out-of-Distribution Detection in Multimodality Multi-Turn Interactive Dialogue Download PDF
  4. MAGIC-VQA: Multimodal And Grounded Inference with Commonsense Knowledge for Visual Question Answering
  5. Multimodal Commonsense Knowledge Distillation for Visual Question Answering (Student Abstract)
  6. 3M-Health: Multimodal Multi-Teacher Knowledge Distillation for Mental Health Detection
  7. MMVQA: A Comprehensive Dataset for Investigating Multipage Multimodal Information Retrieval in PDF-based Visual Question Answering