PPaperPicks

Dong Li

Huawei Technologies, Noah's Ark Lab, Beijing, China

16 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
  2. Bohdi: Heterogeneous LLM Fusion with Automatic Data Exploration
  3. Fast and Slow Gradient Approximation for Binary Neural Network Optimization
  4. Less is More: Efficient Model Merging with Binary Task Switch
  5. Reinforced In-Context Black-Box Optimization
  6. DR-Label: Label Deconstruction and Reconstruction of GNN Models for Catalysis Systems
  7. HarmonyDream: Task Harmonization Inside World Models
  8. Improving Unsupervised Hierarchical Representation With Reinforcement Learning
  9. Interactive Continual Learning: Fast and Slow Thinking
  10. Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces
  11. PG-LBO: Enhancing High-Dimensional Bayesian Optimization with Pseudo-Label and Gaussian Process Guidance
  12. Re-examining Supervised Dimension Reduction for High-Dimensional Bayesian Optimization
  13. SMR: State Memory Replay for Long Sequence Modeling
  14. Sample-Efficient Quality-Diversity by Cooperative Coevolution
  15. Towards Generalizable Neural Solvers for Vehicle Routing Problems via Ensemble with Transferrable Local Policy
  16. iVideoGPT: Interactive VideoGPTs are Scalable World Models