P
PaperPicks
Conferences
Weixun Wang
10 papers at tracked venues · 8 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×6
AAAI
×2
EMNLP
×1
NAACL
×1
Frequent coauthors
Yancheng He
DBLP profile ↗
ORCID search ↗
×2
Xinyu Hu
DBLP profile ↗
ORCID search ↗
×1
Pei Wang
DBLP profile ↗
ORCID search ↗
×1
Hui Huang
DBLP profile ↗
ORCID search ↗
×1
Baolin Zheng
DBLP profile ↗
ORCID search ↗
×1
Shilong Li
DBLP profile ↗
ORCID search ↗
×1
Jian Hu
DBLP profile ↗
ORCID search ↗
×1
Xiaoshuai Song
DBLP profile ↗
ORCID search ↗
×1
Jizhou Wu
DBLP profile ↗
ORCID search ↗
×1
Papers
CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria
ACL 2026
·
Xinyu Hu
DBLP profile ↗
ORCID search ↗
ShopSimulator: Evaluating and Exploring RL-Driven LLM Agent for Shopping Assistants
ACL 2026
·
Pei Wang
DBLP profile ↗
ORCID search ↗
Think-J: Learning to Think for Generative LLM-as-a-Judge
AAAI 2026
·
Hui Huang
DBLP profile ↗
ORCID search ↗
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
ACL 2026
·
Baolin Zheng
DBLP profile ↗
ORCID search ↗
2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision
NAACL 2025
·
Shilong Li
DBLP profile ↗
ORCID search ↗
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
ACL 2025
·
Yancheng He
DBLP profile ↗
ORCID search ↗
Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models
ACL 2025
·
Yancheng He
DBLP profile ↗
ORCID search ↗
OpenRLHF: A Ray-based Easy-to-use, Scalable and High-performance RLHF Framework
EMNLP 2025
·
Jian Hu
DBLP profile ↗
ORCID search ↗
ProgCo: Program Helps Self-Correction of Large Language Models
ACL 2025
·
Xiaoshuai Song
DBLP profile ↗
ORCID search ↗
PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning
AAAI 2024
·
Jizhou Wu
DBLP profile ↗
ORCID search ↗