P
PaperPicks
Conferences
Shichun Liu
15 papers at tracked venues · 12 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×7
AAAI
×2
EMNLP
×2
NeurIPS
×2
ICML
×1
NAACL
×1
Frequent coauthors
Shihan Dou
DBLP profile ↗
ORCID search ↗
×4
Ming Zhang
DBLP profile ↗
ORCID search ↗
×3
Zhiheng Xi
DBLP profile ↗
ORCID search ↗
×2
Jie Yang
DBLP profile ↗
ORCID search ↗
×1
Shaofan Liu
DBLP profile ↗
ORCID search ↗
×1
Jiahang Lin
DBLP profile ↗
ORCID search ↗
×1
Deming Ding
DBLP profile ↗
ORCID search ↗
×1
Yue Zhang
DBLP profile ↗
ORCID search ↗
×1
Wei He
DBLP profile ↗
ORCID search ↗
×1
Papers
ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
ACL 2026
·
Jie Yang
DBLP profile ↗
ORCID search ↗
DARM: Distribution-Aware Reward Modeling by Alleviating Biases from Low Preference-Context Dependency Data
ACL 2026
·
Shaofan Liu
DBLP profile ↗
ORCID search ↗
LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models
ACL 2026
·
Ming Zhang
DBLP profile ↗
ORCID search ↗
MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning
ACL 2026
·
Jiahang Lin
DBLP profile ↗
ORCID search ↗
MetaAct-RL: Training Language Models for Reasoning Through Meta-Action-Based Reinforcement Learning
AAAI 2026
·
Zhiheng Xi
DBLP profile ↗
ORCID search ↗
OctoBench: Benchmarking Scaffold-Aware Instruction Following in Repository-Grounded Agentic Coding
ACL 2026
·
Deming Ding
DBLP profile ↗
ORCID search ↗
EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving
NeurIPS 2025
·
Shihan Dou
DBLP profile ↗
ORCID search ↗
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
EMNLP 2025
·
Ming Zhang
DBLP profile ↗
ORCID search ↗
Lost in the Context: Insufficient and Distracted Attention to Contexts in Preference Modeling
ACL 2025
·
Shihan Dou
DBLP profile ↗
ORCID search ↗
Multi-Programming Language Sandbox for LLMs
ACL 2025
·
Shihan Dou
DBLP profile ↗
ORCID search ↗
Pre-Trained Policy Discriminators are General Reward Models
NeurIPS 2025
·
Shihan Dou
DBLP profile ↗
ORCID search ↗
LLMEval: A Preliminary Study on How to Evaluate Large Language Models
AAAI 2024
·
Yue Zhang
DBLP profile ↗
ORCID search ↗
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
NAACL 2024
·
Wei He
DBLP profile ↗
ORCID search ↗
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
ICML 2024
·
Zhiheng Xi
DBLP profile ↗
ORCID search ↗
TransferTOD: A Generalizable Chinese Multi-Domain Task-Oriented Dialogue System with Transfer Capabilities
EMNLP 2024
·
Ming Zhang
DBLP profile ↗
ORCID search ↗