PPaperPicks

Zhixuan Fang

14 papers at tracked venues · 6 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Efficient and Optimal Policy Gradient Algorithm for Corrupted Multi-armed Bandits
  2. Incentivizing Truth Exploration and Honest Reporting: A Contract Design Approach
  3. Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
  4. Linear Streaming Bandit: Regret Minimization and Fixed-Budget Epsilon-Best Arm Identification
  5. Multi-Armed Bandits with Biased and Heteroscedastic Auxiliary Rewards
  6. Tackling Sparsity in Designated Driver Dispatch with Multi-Agent Reinforcement Learning
  7. User-side Model Consistency Monitoring for Open Source Large Language Models Inference Services
  8. Balanced and Incentivized Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
  9. Decentralized Competing Bandits in Many-to-One Matching Markets
  10. Decentralized Scheduling with QoS Constraints: Achieving O(1) QoS Regret of Multi-Player Bandits
  11. Decentralized Two-Sided Bandit Learning in Matching Market
  12. On Multi-Armed Bandit with Impatient Arms
  13. RL-CFR: Improving Action Abstraction for Imperfect Information Extensive-Form Games with Reinforcement Learning
  14. The Earth is Flat because...: Investigating LLMs' Belief towards Misinformation via Persuasive Conversation