P
PaperPicks
Conferences
Zhixuan Fang
14 papers at tracked venues · 6 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
AAMAS
×6
AAAI
×2
ACL
×2
ICML
×2
CIKM
×1
UAI
×1
Frequent coauthors
Yuming Shao
DBLP profile ↗
ORCID search ↗
×3
Junning Shao
DBLP profile ↗
ORCID search ↗
×2
Yirui Zhang
DBLP profile ↗
ORCID search ↗
×2
Jiayuan Liu
DBLP profile ↗
ORCID search ↗
×1
Zechen Yin
DBLP profile ↗
ORCID search ↗
×1
Jiaxuan Jiang
DBLP profile ↗
ORCID search ↗
×1
Qijun Miao
DBLP profile ↗
ORCID search ↗
×1
Qingsong Liu
DBLP profile ↗
ORCID search ↗
×1
Boning Li
DBLP profile ↗
ORCID search ↗
×1
Rongwu Xu
DBLP profile ↗
ORCID search ↗
×1
Papers
Efficient and Optimal Policy Gradient Algorithm for Corrupted Multi-armed Bandits
AAMAS 2025
·
Jiayuan Liu
DBLP profile ↗
ORCID search ↗
Incentivizing Truth Exploration and Honest Reporting: A Contract Design Approach
AAMAS 2025
·
Yuming Shao
DBLP profile ↗
ORCID search ↗
Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
AAMAS 2025
·
Junning Shao
DBLP profile ↗
ORCID search ↗
Linear Streaming Bandit: Regret Minimization and Fixed-Budget Epsilon-Best Arm Identification
AAAI 2025
·
Yuming Shao
DBLP profile ↗
ORCID search ↗
Multi-Armed Bandits with Biased and Heteroscedastic Auxiliary Rewards
CIKM 2025
·
Zechen Yin
DBLP profile ↗
ORCID search ↗
Tackling Sparsity in Designated Driver Dispatch with Multi-Agent Reinforcement Learning
AAMAS 2025
·
Jiaxuan Jiang
DBLP profile ↗
ORCID search ↗
User-side Model Consistency Monitoring for Open Source Large Language Models Inference Services
ACL 2025
·
Qijun Miao
DBLP profile ↗
ORCID search ↗
Balanced and Incentivized Learning with Limited Shared Information in Multi-agent Multi-armed Bandit
AAMAS 2024
·
Junning Shao
DBLP profile ↗
ORCID search ↗
Decentralized Competing Bandits in Many-to-One Matching Markets
AAMAS 2024
·
Yirui Zhang
DBLP profile ↗
ORCID search ↗
Decentralized Scheduling with QoS Constraints: Achieving O(1) QoS Regret of Multi-Player Bandits
AAAI 2024
·
Qingsong Liu
DBLP profile ↗
ORCID search ↗
Decentralized Two-Sided Bandit Learning in Matching Market
UAI 2024
·
Yirui Zhang
DBLP profile ↗
ORCID search ↗
On Multi-Armed Bandit with Impatient Arms
ICML 2024
·
Yuming Shao
DBLP profile ↗
ORCID search ↗
RL-CFR: Improving Action Abstraction for Imperfect Information Extensive-Form Games with Reinforcement Learning
ICML 2024
·
Boning Li
DBLP profile ↗
ORCID search ↗
The Earth is Flat because...: Investigating LLMs' Belief towards Misinformation via Persuasive Conversation
ACL 2024
·
Rongwu Xu
DBLP profile ↗
ORCID search ↗