PPaperPicks

Yuexin Bian

2 papers at tracked venues · 2 at CORE A* · active 20252026

Venues

Frequent coauthors

Jorge (Zhoujun) Cheng
×1

Papers

  1. DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
    AAAI 2026 · Yuexin Bian
  2. Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective