P
PaperPicks
Conferences
Qi Yi
8 papers at tracked venues · 8 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×4
AAAI
×3
ICML
×1
Frequent coauthors
Zefang Zong
DBLP profile ↗
ORCID search ↗
×1
Guanhua Huang
DBLP profile ↗
ORCID search ↗
×1
Siheng Li
DBLP profile ↗
ORCID search ↗
×1
Ziyuan Nan
DBLP profile ↗
ORCID search ↗
×1
Enshuai Zhou
DBLP profile ↗
ORCID search ↗
×1
Shaohui Peng
DBLP profile ↗
ORCID search ↗
×1
Fan Wu
DBLP profile ↗
ORCID search ↗
×1
Haihan Gao
DBLP profile ↗
ORCID search ↗
×1
Papers
AT²PO: Agentic Turn-based Policy Optimization via Tree Search
ACL 2026
·
Zefang Zong
DBLP profile ↗
ORCID search ↗
Low-probability Tokens Sustain Exploration in Reinforcement Learning with Verifiable Reward
ACL 2026
·
Guanhua Huang
DBLP profile ↗
ORCID search ↗
Reinforcement Learning on Pre-Training Data
ACL 2026
·
Siheng Li
DBLP profile ↗
ORCID search ↗
Rhombus: Incentivizing Coordination in Parallel Thinking through Reinforcement Learning
ACL 2026
·
Ziyuan Nan
DBLP profile ↗
ORCID search ↗
Emergent Communication for Numerical Concepts Generalization
AAAI 2024
·
Enshuai Zhou
DBLP profile ↗
ORCID search ↗
Hypothesis, Verification, and Induction: Grounding Large Language Models with Self-Driven Skill Learning
AAAI 2024
·
Shaohui Peng
DBLP profile ↗
ORCID search ↗
OCEAN-MBRL: Offline Conservative Exploration for Model-Based Offline Reinforcement Learning
AAAI 2024
·
Fan Wu
DBLP profile ↗
ORCID search ↗
Prompt-based Visual Alignment for Zero-shot Policy Transfer
ICML 2024
·
Haihan Gao
DBLP profile ↗
ORCID search ↗