PPaperPicks

Xingzhou Lou

6 papers at tracked venues · 5 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Calibration-Aware Policy Optimization for Reasoning LLMs
  2. Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
    AAAI 2025 · Xingzhou Lou
  3. Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards
  4. Position: Foundation Agents as the Paradigm Shift for Decision Making
  5. Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
    AAMAS 2024 · Xingzhou Lou
  6. TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
    AAAI 2024 · Xingzhou Lou