PPaperPicks

Shichun Liu

15 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
  2. DARM: Distribution-Aware Reward Modeling by Alleviating Biases from Low Preference-Context Dependency Data
  3. LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models
  4. MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning
  5. MetaAct-RL: Training Language Models for Reasoning Through Meta-Action-Based Reinforcement Learning
  6. OctoBench: Benchmarking Scaffold-Aware Instruction Following in Repository-Grounded Agentic Coding
  7. EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving
  8. LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
  9. Lost in the Context: Insufficient and Distracted Attention to Contexts in Preference Modeling
  10. Multi-Programming Language Sandbox for LLMs
  11. Pre-Trained Policy Discriminators are General Reward Models
  12. LLMEval: A Preliminary Study on How to Evaluate Large Language Models
  13. Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
  14. Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
  15. TransferTOD: A Generalizable Chinese Multi-Domain Task-Oriented Dialogue System with Transfer Capabilities