PPaperPicks

Wei Li

12 papers at tracked venues · 9 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and a Comprehensive Multimodal Dataset Towards General Medical AI
  2. MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
  3. MedGround-R1: Advancing Medical Image Grounding via Spatial-Semantic Rewarded Group Relative Policy Optimization
  4. OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
  5. OpenHuEval: Evaluating Large Language Model on Hungarian Specifics
  6. OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining
  7. Ophora: A Large-Scale Data-Driven Text-Guided Ophthalmic Surgical Video Generation Model
    MICCAI 2025 · Wei Li
  8. RetinaLogos: Fine-Grained Synthesis of High-Resolution Retinal Images Through Captions
  9. Benchmarking Chinese Commonsense Reasoning of LLMs: From Chinese-Specifics to Reasoning-Memorization Correlations
  10. GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
  11. InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD
  12. VIGC: Visual Instruction Generation and Correction