PPaperPicks

Shiyu Li

8 papers at tracked venues · 7 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Putting Captions to the Test: Evaluating Video Caption Quality through Multiple-Choice Question Answering
  2. Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
  3. Web Sitemap Knowledge Can Enhance Autonomous Browsing
  4. Conan-Embedding-v2: Training an LLM from Scratch for Text Embeddings
    EMNLP 2025 · Shiyu Li
  5. DigitalLLaVA: Incorporating Digital Cognition Capability for Physical World Comprehension in Multimodal LLMs
    AAAI 2025 · Shiyu Li
  6. StreamBridge: Turning Your Offline Video Large Language Model into a Proactive Streaming Assistant
  7. Unified Open-World Segmentation with Multi-Modal Prompts
  8. ODGEN: Domain-specific Object Detection Data Generation with Diffusion Models