PPaperPicks

John C. S. Lui

Chinese University of Hong Kong, Department of Computer Science and Engineering, Hong Kong

32 papers at tracked venues · 29 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Multi-Agent Conversational Bandit Approach to Online Evaluation and Selection of User-Aligned LLM Responses
  2. BANCO: Drift-Aware Batched Bandits for Adaptive Proximity Graph Pruning
  3. Large Language Model-Enhanced Multi-Armed Bandits
  4. Online Multi-LLM Selection via Contextual Bandits Under Unstructured Context Evolution
  5. Trading Vector Data in Vector Databases
  6. A Unified Online-Offline Framework for Co-Branding Campaign Recommendations
  7. An Enhanced Levenberg-Marquardt Method via Gram Reduction
  8. Bandit Learning in Matching Markets with Indifference
  9. Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial Contexts
  10. Federated In-Context Learning: Iterative Refinement for Improved Answer Quality
  11. Fusing Reward and Dueling Feedback in Stochastic Bandits
  12. Leveraging the Power of Conversations: Optimal Key Term Selection in Conversational Contextual Bandits
  13. Model-based RL as a Minimalist Approach to Horizon-Free and Second-Order Bounds
  14. OSTOR: Online Scheduling Framework for Trading Continuous Queries
  15. Offline Learning for Combinatorial Multi-armed Bandits
  16. Online Clustering of Dueling Bandits
  17. Provable Zero-Shot Generalization in Offline Reinforcement Learning
  18. Quantum Algorithms for Finite-horizon Markov Decision Processes
  19. Quantum Best Arm Identification with Quantum Oracles
  20. Quantum Speedups for Minimax Optimization and Beyond
  21. Stochastic Bandits Robust to Adversarial Attacks
  22. Time Matters: Enhancing Sequential Recommendations with Time-Guided Graph Neural ODEs
  23. Towards Efficient Conversational Recommendations: Expected Value of Information Meets Bandit Learning
  24. Variance-Dependent Regret Bounds for Nonstationary Linear Bandits
  25. AxiomVision: Accuracy-Guaranteed Adaptive Visual Model Selection for Perspective-Aware Video Analytics
  26. Combinatorial Multivariant Multi-Armed Bandits with Applications to Episodic Reinforcement Learning and Beyond
  27. D-LLM: A Token Adaptive Computing Resource Allocation Strategy for Large Language Models
  28. FedConPE: Efficient Federated Conversational Bandits with Heterogeneous Clients
  29. Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
  30. Merit-Based Fair Combinatorial Semi-Bandit with Unrestricted Feedback Delays
  31. Quantum Algorithm for Online Exp-concave Optimization
  32. Quantum Algorithms for Non-smooth Non-convex Optimization