PPaperPicks

Qichao Zhang

16 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
  2. Beyond Query Memorization: Large Language Model Routing with Query Decomposition and Historical Matching
  3. CriticSearch: Fine-Grained Credit Assignment for Search Agents via a Retrospective Critic
  4. Spec-o3: A Tool-Augmented Vision-Language Agent for Rare Celestial Object Candidate Vetting via Automated Spectral Inspection
  5. WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving
  6. Consistency Policy with Categorical Critic for Autonomous Driving
  7. In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
  8. Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
  9. Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
  10. RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
  11. Salience-Invariant Consistent Policy Learning for Generalization in Visual Reinforcement Learning
  12. UncAD: Towards Safe End-to-end Autonomous Driving via Online Map Uncertainty
  13. Unsupervised Zero-Shot Reinforcement Learning via Dual-Value Forward-Backward Representation
  14. World4Drive: End-to-End Autonomous Driving via Intention-Aware Physical Latent World Model
  15. MonoOcc: Digging into Monocular Semantic Occupancy Prediction
  16. User Response Modeling in Reinforcement Learning for Ads Allocation