P
PaperPicks
Conferences
Baolin Peng
22 papers at tracked venues · 16 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×5
ICLR
×4
NeurIPS
×4
EMNLP
×3
NAACL
×3
AAAI
×1
CVPR
×1
ICML
×1
Frequent coauthors
Ante Wang
DBLP profile ↗
ORCID search ↗
×3
Xiao Yu
DBLP profile ↗
ORCID search ↗
×2
Xiaoying Zhang
DBLP profile ↗
ORCID search ↗
×2
Hang Wang
DBLP profile ↗
ORCID search ↗
×1
Zhaoyang Wang
DBLP profile ↗
ORCID search ↗
×1
Shirley Wu
DBLP profile ↗
ORCID search ↗
×1
Liliang Ren
DBLP profile ↗
ORCID search ↗
×1
Qianhui Wu
DBLP profile ↗
ORCID search ↗
×1
Yuheng Zhang
DBLP profile ↗
ORCID search ↗
×1
Seonghyeon Ye
DBLP profile ↗
ORCID search ↗
×1
Jianwei Yang
DBLP profile ↗
ORCID search ↗
×1
Yiping Wang
DBLP profile ↗
ORCID search ↗
×1
Papers
LEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval
ACL 2026
·
Hang Wang
DBLP profile ↗
ORCID search ↗
SynthAgent: Adapting Web Agents with Synthetic Supervision
ACL 2026
·
Zhaoyang Wang
DBLP profile ↗
ORCID search ↗
CollabLLM: From Passive Responders to Active Collaborators
ICML 2025
·
Shirley Wu
DBLP profile ↗
ORCID search ↗
Decoder-Hybrid-Decoder Architecture for Efficient Reasoning with Long Generation
NeurIPS 2025
·
Liliang Ren
DBLP profile ↗
ORCID search ↗
ExACT: Teaching AI Agents to Explore with Reflective-MCTS and Exploratory Learning
ICLR 2025
·
Xiao Yu
DBLP profile ↗
ORCID search ↗
GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
NeurIPS 2025
·
Qianhui Wu
DBLP profile ↗
ORCID search ↗
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
ICLR 2025
·
Yuheng Zhang
DBLP profile ↗
ORCID search ↗
Latent Action Pretraining from Videos
ICLR 2025
·
Seonghyeon Ye
DBLP profile ↗
ORCID search ↗
LiteSearch: Efficient Tree Search with Dynamic Exploration Budget for Math Reasoning
AAAI 2025
·
Ante Wang
DBLP profile ↗
ORCID search ↗
Magma: A Foundation Model for Multimodal AI Agents
CVPR 2025
·
Jianwei Yang
DBLP profile ↗
ORCID search ↗
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
NeurIPS 2025
·
Yiping Wang
DBLP profile ↗
ORCID search ↗
Self-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching
ACL 2025
·
Xiaoying Zhang
DBLP profile ↗
ORCID search ↗
SimulatorArena: Are User Simulators Reliable Proxies for Multi-Turn Evaluation of AI Assistants?
EMNLP 2025
·
Yao Dou
DBLP profile ↗
ORCID search ↗
Evaluating the Instruction-Following Robustness of Large Language Models to Prompt Injection
EMNLP 2024
·
Zekun Li
DBLP profile ↗
ORCID search ↗
Improving LLM Generations via Fine-Grained Self-Endorsement
ACL 2024
·
Ante Wang
DBLP profile ↗
ORCID search ↗
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
ACL 2024
·
Xiaoying Zhang
DBLP profile ↗
ORCID search ↗
Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language Models
NAACL 2024
·
Miaoran Li
DBLP profile ↗
ORCID search ↗
Self-Consistency Boosts Calibration for Math Reasoning
EMNLP 2024
·
Ante Wang
DBLP profile ↗
ORCID search ↗
Sub-Sentence Encoder: Contrastive Learning of Propositional Semantic Representations
NAACL 2024
·
Sihao Chen
DBLP profile ↗
ORCID search ↗
Teaching Language Models to Self-Improve through Interactive Demonstrations
NAACL 2024
·
Xiao Yu
DBLP profile ↗
ORCID search ↗
The Trickle-down Impact of Reward Inconsistency on RLHF
ICLR 2024
·
Lingfeng Shen
DBLP profile ↗
ORCID search ↗
Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing
NeurIPS 2024
·
Ye Tian
DBLP profile ↗
ORCID search ↗