PPaperPicks

Bosi Wen

11 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. IF-CRITIC: Towards a Fine-Grained LLM Critic for Instruction-Following Evaluation
    ACL 2026 · Bosi Wen
  2. IF-RewardBench: Benchmarking Judge Models for Instruction-Following Evaluation
    ACL 2026 · Bosi Wen
  3. RLMR: Reinforcement Learning with Mixed Rewards for Creative Writing
  4. CharacterBench: Benchmarking Character Customization of Large Language Models
  5. HPSS: Heuristic Prompting Strategy Search for LLM Evaluators
    ACL 2025 · Bosi Wen
  6. Training Language Model to Critique for Better Refinement
  7. AlignBench: Benchmarking Chinese Alignment of Large Language Models
  8. Benchmarking Complex Instruction-Following with Multiple Constraints Composition
    NeurIPS 2024 · Bosi Wen
  9. CharacterGLM: Customizing Social Characters with Large Language Models
  10. CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
  11. ToMBench: Benchmarking Theory of Mind in Large Language Models