P
PaperPicks
Conferences
Xingzhou Lou
6 papers at tracked venues · 5 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×2
AAMAS
×1
ACL
×1
ICML
×1
NeurIPS
×1
Frequent coauthors
Ziqi Wang
DBLP profile ↗
ORCID search ↗
×1
Honghao Chen
DBLP profile ↗
ORCID search ↗
×1
Xiaoqian Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Calibration-Aware Policy Optimization for Reasoning LLMs
ACL 2026
·
Ziqi Wang
DBLP profile ↗
ORCID search ↗
Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
AAAI 2025
·
Xingzhou Lou
Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards
NeurIPS 2025
·
Honghao Chen
DBLP profile ↗
ORCID search ↗
Position: Foundation Agents as the Paradigm Shift for Decision Making
ICML 2024
·
Xiaoqian Liu
DBLP profile ↗
ORCID search ↗
Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
AAMAS 2024
·
Xingzhou Lou
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
AAAI 2024
·
Xingzhou Lou