PPaperPicks

Zheng Liu

Beijing Academy of Artificial Intelligence, China

50 papers at tracked venues · 42 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AWARE: Agentic Knowledge Warehousing for Contextual Intelligence
  2. AgentFactory: A Self-Evolving Framework Through Executable Subagent Accumulation and Reuse
  3. Let Retrievers Think Before Action: Thought-Augmented Embedding for Dense Retrieval
  4. MemoBrain: Executive Memory as an Agentic Brain for Reasoning
  5. PaperScope: A Multi-Modal Multi-Document Benchmark for Agentic Deep Research Across Massive Scientific Papers
  6. ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
  7. Reinforcing Agentic Search Via Reward Density Optimization
  8. RetroLM: Retrieval-Augmented KVs for Long-Context Processing
  9. Towards Effective Code-Integrated Reasoning
  10. AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
  11. Any Information Is Just Worth One Single Screenshot: Unifying Search With Visualized Information Retrieval
    ACL 2025 · Zheng Liu
  12. Boosting Long-Context Information Seeking via Query-Guided Activation Refilling
  13. Feint and Attack: Jailbreaking and Protecting LLMs via Attention Distribution Modeling
  14. Fitting Into Any Shape: A Flexible LLM-Based Re-Ranker With Configurable Depth and Width
    WWW 2025 · Zheng Liu
  15. HawkBench: Investigating Resilience of RAG Methods on Stratified Information-Seeking Tasks
  16. Lighter And Better: Towards Flexible Context Adaptation For Retrieval Augmented Generation
  17. Long Context Compression with Activation Beacon
  18. MLVU: Benchmarking Multi-task Long Video Understanding
  19. MRR-FV: Unlocking Complex Fact Verification with Multi-Hop Retrieval and Reasoning
  20. Making Text Embedders Few-Shot Learners
  21. MegaPairs: Massive Data Synthesis for Universal Multimodal Retrieval
  22. MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
  23. MomentSeeker: A Task-Oriented Benchmark For Long-Video Moment Retrieval
  24. OmniGen: Unified Image Generation
  25. Reinforced IR: A Self-Boosting Framework For Domain-Adapted Information Retrieval
  26. Scent of Knowledge: Optimizing Search-Enhanced Reasoning with Information Foraging
  27. SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
  28. Single LLM, Multiple Roles: A Unified Retrieval-Augmented Generation Framework Using Role-Specific Token Optimization
  29. Tackling the Length Barrier: Dynamic Context Browsing for Knowledge-Intensive Task
  30. Towards A Generalist Code Embedding Model Based On Massive Data Synthesis
  31. Unveiling the Ignorance of MLLMs: Seeing Clearly, Answering Incorrectly
  32. Video-XL: Extra-Long Vision Language Model for Hour-Scale Video Understanding
  33. A Multi-Task Embedder For Retrieval Augmented LLMs
  34. Boosting the Potential of Large Language Models with an Intelligent Information Assistant
  35. C-Pack: Packed Resources For General Chinese Embeddings
  36. ChatRetriever: Adapting Large Language Models for Generalized and Robust Conversational Dense Retrieval
  37. Generative Retrieval via Term Set Generation
  38. Grounding Language Model with Chunking-Free In-Context Retrieval
  39. INTERS: Unlocking the Power of Large Language Models in Search with Instruction Tuning
  40. Information Retrieval Meets Large Language Models
    WWW 2024 · Zheng Liu
  41. LM-Cocktail: Resilient Tuning of Language Models via Model Merging
  42. Landmark Embedding: A Chunking-Free Embedding Method For Retrieval Augmented Long-Context Large Language Models
  43. Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment
  44. Llama2Vec: Unsupervised Adaptation of Large Language Models for Dense Retrieval
  45. M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
  46. MS MARCO Web Search: A Large-scale Information-rich Web Dataset with Millions of Real Click Labels
  47. Metacognitive Retrieval-Augmented Large Language Models
  48. Negating Negatives: Alignment with Human Negative Samples via Distributional Dispreference Optimization
  49. RAG-Studio: Towards In-Domain Adaptation of Retrieval Augmented Generation Through Self-Alignment
  50. VISTA: Visualized Text Embedding For Universal Multi-Modal Retrieval