PPaperPicks

Yangyi Fang

7 papers at tracked venues · 7 at CORE A* · active 20262026

Venues

Frequent coauthors

Papers

  1. From łog π to π: Taming Divergence in Soft Clipping via Bilateral Decoupled Decay of Probability Gradient Weight
  2. Gesture Clustering for Real-Time User Disentanglement in Shared-Account Recommendation
  3. How to Allocate, How to Learn? Dynamic Rollout Allocation and Advantage Modulation for Policy Optimization
    ACL 2026 · Yangyi Fang
  4. MASPO: Unifying Gradient Utilization, Probability Mass, and Signal Reliability for Robust and Sample-Efficient LLM Reasoning
  5. Multi-granularity Intent Modeling with Adversarial Robustness for Sequential Recommendation
    AAAI 2026 · Yangyi Fang
  6. Placing Puzzle Pieces Where They Matter: A Question Augmentation Framework for Reinforcement Learning
    ACL 2026 · Yangyi Fang
  7. Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
    ACL 2026 · Yangyi Fang