PPaperPicks

Zehui Chen

24 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Beyond Accuracy: Unveiling Inefficiency Patterns in Tool-Integrated Reasoning
  2. Breaking Block Boundaries: Anchor-based History-stable Decoding for Diffusion Large Language Models
  3. UniCorn: Towards Self-Improving Unified Multimodal Models through Self-Generated Supervision
  4. CRITICTOOL: Evaluating Self-Critique Capabilities of Large Language Models in Tool-Calling Error Scenarios
  5. Enhancing Large Vision-Language Models with Ultra-Detailed Image Caption Generation
  6. LiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR Understanding
  7. MMSearch: Unveiling the Potential of Large Models as Multi-modal Search Engines
  8. MindSearch: Mimicking Human Minds Elicits Deep AI Searcher
    ICLR 2025 · Zehui Chen
  9. PseDet: Revisiting the Power of Pseudo Label in Incremental Object Detection
  10. ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
  11. VFM-Adapter: Adapting Visual Foundation Models for Dense Prediction with Dynamic Hybrid Operation Mapping
  12. VRAG-RL: Empower Vision-Perception-Based RAG for Visually Rich Information Understanding via Iterative Reasoning with Reinforcement Learning
  13. ViDoRAG: Visual Document Retrieval-Augmented Generation via Dynamic Iterative Reasoning Agents
  14. Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
    ACL 2024 · Zehui Chen
  15. Are We on the Right Way for Evaluating Large Vision-Language Models?
  16. BEVUDA: Multi-geometric Space Alignments for Domain Adaptive BEV 3D Object Detection
  17. Continual-MAE: Adaptive Distribution Masked Autoencoders for Continual Test-Time Adaptation
  18. Distribution-Aware Continual Test-Time Adaptation for Semantic Segmentation
  19. Exploring Sparse Visual Prompt for Domain Adaptive Dense Prediction
  20. Leveraging Imagery Data with Spatial Point Prior for Weakly Semi-supervised 3D Object Detection
  21. PlainMamba: Improving Non-Hierarchical Mamba in Visual Recognition
  22. ShareGPT4Video: Improving Video Understanding and Generation with Better Captions
  23. Stream Query Denoising for Vectorized HD-Map Construction
  24. T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
    ACL 2024 · Zehui Chen