PPaperPicks

Zhihang Liu

6 papers at tracked venues · 5 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. RegionRAG: Region-level Retrieval-Augmented Generation for Visual Document Understanding
  2. SpaceVLLM: Endowing Multimodal Large Language Model with Spatio-Temporal Video Grounding Capability
  3. CAPability: A Comprehensive Visual Caption Benchmark for Evaluating Both Correctness and Thoroughness
    NeurIPS 2025 · Zhihang Liu
  4. Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models
    CVPR 2025 · Zhihang Liu
  5. CLIP-based Cross-Level Semantic Interaction and Recombination Network for Composed Image Retrieval
    ECAI 2024 · Zhihang Liu
  6. Towards Balanced Alignment: Modal-Enhanced Semantic Modeling for Video Moment Retrieval
    AAAI 2024 · Zhihang Liu