PPaperPicks

Lu Wang

Microsoft, Beijing, China

24 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Break Through the Compression Bottleneck: From Theory to Practice
  2. DUET: Joint Exploration of User-Item Profiles in Recommendation System
  3. Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
  4. RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
  5. Theory-optimal Quantization Based on Flatness
  6. Zipage: Maintain High Request Concurrency for LLM Reasoning through Compressed PagedAttention
  7. AXIS: Efficient Human-Agent-Computer Interaction with API-First LLM-Based Agents
  8. AdaptFlow: Adaptive Workflow Optimization via Meta-Learning
  9. ICL-Bandit: Relevance Labeling in Advertisement Recommendation Systems via LLM
    EMNLP 2025 · Lu Wang
  10. LettinGo: Explore User Profile Generation for Recommendation System
    SIGKDD 2025 · Lu Wang
  11. ProtoRAIL: A Risk-cognizant Imitation Agent for Adaptive vCPU Oversubscription In the Cloud
    MLSys 2025 · Lu Wang
  12. RuAG: Learned-rule-augmented Generation for Large Language Models
  13. Self-Evolved Reward Learning for LLMS
  14. Thread: A Logic-Based Data Organization Paradigm for How-To Question Answering with Retrieval Augmented Generation
  15. Token-level Proximal Policy Optimization for Query Generation
  16. WarriorCoder: Learning from Expert Battles to Augment Code Large Language Models
  17. AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
  18. Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
  19. COIN: Chance-Constrained Imitation Learning for Safe and Adaptive Resource Oversubscription under Uncertainty
    CIKM 2024 · Lu Wang
  20. Everything of Thoughts: Defying the Law of Penrose Triangle for Thought Generation
  21. Interpretable Imitation Learning with Dynamic Causal Relations
  22. Nissist: An Incident Mitigation Copilot based on Troubleshooting Guides
  23. SELF-GUARD: Empower the LLM to Safeguard Itself
  24. SMuCo: Reinforcement Learning for Visual Control via Sequential Multi-view Total Correlation