P
PaperPicks
Conferences
Dong Yan
8 papers at tracked venues · 7 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×2
ICLR
×2
ICML
×2
AAAI
×1
EMNLP
×1
Frequent coauthors
Yuzi Yan
DBLP profile ↗
ORCID search ↗
×2
Ziyi Ye
DBLP profile ↗
ORCID search ↗
×1
Tianyi Alex Qiu
DBLP profile ↗
ORCID search ↗
×1
Yichi Zhang
DBLP profile ↗
ORCID search ↗
×1
Xingzhou Lou
DBLP profile ↗
ORCID search ↗
×1
Binghai Wang
DBLP profile ↗
ORCID search ↗
×1
Papers
What If Consensus Lies? Selective-Complementary Reinforcement Learning at Test Time
ACL 2026
·
Dong Yan
3D-Properties: Identifying Challenges in DPO and Charting a Path Forward
ICLR 2025
·
Yuzi Yan
DBLP profile ↗
ORCID search ↗
Learning LLM-as-a-Judge for Preference Alignment
ICLR 2025
·
Ziyi Ye
DBLP profile ↗
ORCID search ↗
Reward Generalization in RLHF: A Topological Perspective
ACL 2025
·
Tianyi Alex Qiu
DBLP profile ↗
ORCID search ↗
STAIR: Improving Safety Alignment with Introspective Reasoning
ICML 2025
·
Yichi Zhang
DBLP profile ↗
ORCID search ↗
Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
AAAI 2025
·
Xingzhou Lou
DBLP profile ↗
ORCID search ↗
Exploring the LLM Journey from Cognition to Expression with Linear Representations
ICML 2024
·
Yuzi Yan
DBLP profile ↗
ORCID search ↗
Reward Modeling Requires Automatic Adjustment Based on Data Quality
EMNLP 2024
·
Binghai Wang
DBLP profile ↗
ORCID search ↗