PPaperPicks

Bo Wang

8 papers at tracked venues · 5 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
  2. Efficient KL Divergence Estimation via Truncated Top-K Integration for Large Language Models
  3. Time-Frequency Token Advantage Clipping for Training Efficient Large Reasoning Model
  4. BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
  5. Implicit Reward as the Bridge: A Unified View of SFT and DPO Connections
    NeurIPS 2025 · Bo Wang
  6. R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
  7. REARANK: Reasoning Re-ranking Agent via Reinforcement Learning
  8. Memorize Step by Step: Efficient Long-Context Prefilling with Incremental Memory and Decremental Chunk