P
PaperPicks
Conferences
Bosi Wen
11 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×7
AAAI
×2
EMNLP
×1
NeurIPS
×1
Frequent coauthors
Jinfeng Zhou
DBLP profile ↗
ORCID search ↗
×2
Jianxing Liao
DBLP profile ↗
ORCID search ↗
×1
Tianshu Yu
DBLP profile ↗
ORCID search ↗
×1
Xiao Liu
DBLP profile ↗
ORCID search ↗
×1
Pei Ke
DBLP profile ↗
ORCID search ↗
×1
Zhuang Chen
DBLP profile ↗
ORCID search ↗
×1
Papers
IF-CRITIC: Towards a Fine-Grained LLM Critic for Instruction-Following Evaluation
ACL 2026
·
Bosi Wen
IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation
ACL 2026
·
Bosi Wen
RLMR: Reinforcement Learning with Mixed Rewards for Creative Writing
AAAI 2026
·
Jianxing Liao
DBLP profile ↗
ORCID search ↗
CharacterBench: Benchmarking Character Customization of Large Language Models
AAAI 2025
·
Jinfeng Zhou
DBLP profile ↗
ORCID search ↗
HPSS: Heuristic Prompting Strategy Search for LLM Evaluators
ACL 2025
·
Bosi Wen
Training Language Model to Critique for Better Refinement
ACL 2025
·
Tianshu Yu
DBLP profile ↗
ORCID search ↗
AlignBench: Benchmarking Chinese Alignment of Large Language Models
ACL 2024
·
Xiao Liu
DBLP profile ↗
ORCID search ↗
Benchmarking Complex Instruction-Following with Multiple Constraints Composition
NeurIPS 2024
·
Bosi Wen
CharacterGLM: Customizing Social Characters with Large Language Models
EMNLP 2024
·
Jinfeng Zhou
DBLP profile ↗
ORCID search ↗
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
ACL 2024
·
Pei Ke
DBLP profile ↗
ORCID search ↗
ToMBench: Benchmarking Theory of Mind in Large Language Models
ACL 2024
·
Zhuang Chen
DBLP profile ↗
ORCID search ↗