PPaperPicks

Bo Zhang

Shanghai AI Laboratory, China

31 papers at tracked venues · 29 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement
  2. A Survey of Reinforcement Learning for Large Language Models under Data Scarcity: Challenges and Solutions
  3. Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
  4. FlowRAG: Synergizing Explicit Reasoning via Frequency-Aware Multi-Granularity Graph Flow
  5. FlowSearch: Advancing Deep Research with Dynamic Structured Knowledge Flow
  6. MTRouter: Cost-Aware Multi-Turn LLM Routing with History-Model Joint Embeddings
  7. MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
  8. ViG-RAG: Video-aware Graph Retrieval-Augmented Generation via Temporal and Semantic Hybrid Reasoning
  9. Breaking the Compression Ceiling: Data-Free Pipeline for Ultra-Efficient Delta Compression
  10. Chimera: Improving Generalist Model with Domain-Specific Experts
  11. Dolphin: Moving Towards Closed-loop Auto-research through Thinking, Practice, and Feedback
  12. GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
  13. Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
  14. JiSAM: Alleviate Labeling Burden and Corner Case Problems in Autonomous Driving via Minimal Real-World Data
  15. Lumina-Image 2.0: a Unified and Efficient Image Generative Framework
  16. MAP: Parameter-Efficient Tuning for Referring Expression Comprehension via Multi-Modal Adaptive Positional Encoding
  17. MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
  18. OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
  19. OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
  20. SURVEYFORGE : On the Outline Heuristics, Memory-Driven Generation, and Multi-dimensional Evaluation for Automated Survey Writing
  21. TREND: Unsupervised 3D Representation Learning via Temporal Forecasting for LiDAR Perception
  22. Temporal Overlapping Prediction: A Self-Supervised Pre-Training Method for LiDAR Moving Object Segmentation
  23. Continuously Learning, Adapting, and Improving: A Dual-Process Approach to Autonomous Driving
  24. Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
  25. On the Emergence of Cross-Task Linearity in Pretraining-Finetuning Paradigm
  26. Once for Both: Single Stage of Importance and Sparsity Search for Vision Transformer Compression
  27. ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
    ICLR 2024 · Bo Zhang
  28. Realistic Rainy Weather Simulation for LiDARs in CARLA Simulator
  29. Reg-TTA3D: Better Regression Makes Better Test-Time Adaptive 3D Object Detection
  30. Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
  31. ZOPP: A Framework of Zero-shot Offboard Panoptic Perception for Autonomous Driving