P
PaperPicks
Conferences
Yuexin Bian
2 papers at tracked venues · 2 at CORE A* · active 2025–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×1
NeurIPS
×1
Frequent coauthors
Jorge (Zhoujun) Cheng
DBLP profile ↗
ORCID search ↗
×1
Papers
DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
AAAI 2026
·
Yuexin Bian
Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective
NeurIPS 2025
·
Jorge (Zhoujun) Cheng
DBLP profile ↗
ORCID search ↗