P
PaperPicks
Conferences
Yan Zheng
Tianjin University, China
31 papers at tracked venues · 26 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-2741-058X ↗
Google Scholar ↗
Homepage ↗
Venues
NeurIPS
×7
AAAI
×5
ICML
×5
AAMAS
×3
WWW
×3
ACL
×2
ICLR
×2
CVPR
×1
ICCV
×1
IJCAI
×1
UAI
×1
Frequent coauthors
Pengyi Li
DBLP profile ↗
ORCID search ↗
×5
Zibin Dong
DBLP profile ↗
ORCID search ↗
×3
Longxin Kou
DBLP profile ↗
ORCID search ↗
×2
Yibin Chen
DBLP profile ↗
ORCID search ↗
×2
Jinyi Liu
DBLP profile ↗
ORCID search ↗
×2
Kai Zhao
DBLP profile ↗
ORCID search ↗
×2
Fei Ni
DBLP profile ↗
ORCID search ↗
×2
Jiashun Liu
DBLP profile ↗
ORCID search ↗
×2
Hebin Liang
DBLP profile ↗
ORCID search ↗
×1
Qian Zhang
DBLP profile ↗
ORCID search ↗
×1
Rong Cheng
DBLP profile ↗
ORCID search ↗
×1
Tianpei Yang
DBLP profile ↗
ORCID search ↗
×1
Papers
AFE-Master: Enhancing LLM-Driven Autonomous Feature Engineering with Domain-Specific Language Parsing and Guided Local Search
WWW 2026
·
Hebin Liang
DBLP profile ↗
ORCID search ↗
Key Decision-Makers in Multi-Agent Debates: Who Holds the Power?
AAAI 2026
·
Qian Zhang
DBLP profile ↗
ORCID search ↗
COLA: Towards Efficient Multi-Objective Reinforcement Learning with Conflict Objective Regularization in Latent Space
NeurIPS 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
ACL 2025
·
Rong Cheng
DBLP profile ↗
ORCID search ↗
LaRes: Evolutionary Reinforcement Learning with LLM-based Adaptive Reward Search
NeurIPS 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
R*: Efficient Reward Design via Reward Structure Evolution and Parameter Alignment Optimization with Large Language Models
ICML 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
RoboAnnotatorX: A Comprehensive and Universal Annotation Framework for Accurate Understanding of Long-Horizon Robot Demonstration
ICCV 2025
·
Longxin Kou
DBLP profile ↗
ORCID search ↗
SheetAgent: Towards a Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
WWW 2025
·
Yibin Chen
DBLP profile ↗
ORCID search ↗
War of Thoughts: Competition Stimulates Stronger Reasoning in Large Language Models
ACL 2025
·
Yibin Chen
DBLP profile ↗
ORCID search ↗
A Trajectory Perspective on the Role of Data Sampling Techniques in Offline Reinforcement Learning
AAMAS 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
A Transfer Approach Using Graph Neural Networks in Deep Reinforcement Learning
AAAI 2024
·
Tianpei Yang
DBLP profile ↗
ORCID search ↗
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
ICLR 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making
NeurIPS 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
DiffuserLite: Towards Real-time Diffusion Planning
NeurIPS 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
AAMAS 2024
·
Kai Zhao
DBLP profile ↗
ORCID search ↗
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
IJCAI 2024
·
Kai Zhao
DBLP profile ↗
ORCID search ↗
EvoRainbow: Combining Improvements in Evolutionary Reinforcement Learning for Policy Search
ICML 2024
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
Generate Subgoal Images Before Act: Unlocking the Chain-of-Thought Reasoning in Diffusion Model for Robot Manipulation with Multimodal Prompts
CVPR 2024
·
Fei Ni
DBLP profile ↗
ORCID search ↗
Hybrid CtrlFormer: Learning Adaptive Search Space Partition for Hybrid Action Control via Transformer-based Monte Carlo Tree Search
UAI 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Improving Neural Logic Machines via Failure Reflection
ICML 2024
·
Zhiming Li
DBLP profile ↗
ORCID search ↗
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
NeurIPS 2024
·
Yi Ma
DBLP profile ↗
ORCID search ↗
KISA: A Unified Keyframe Identifier and Skill Annotator for Long-Horizon Robotics Demonstrations
ICML 2024
·
Longxin Kou
DBLP profile ↗
ORCID search ↗
Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces
AAAI 2024
·
Xiaotian Hao
DBLP profile ↗
ORCID search ↗
OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments
AAAI 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
PADDLE: Logic Program Guided Policy Reuse in Deep Reinforcement Learning
AAMAS 2024
·
Hao Zhang
DBLP profile ↗
ORCID search ↗
PERIA: Perceive, Reason, Imagine, Act via Holistic Language and Vision Planning for Manipulation
NeurIPS 2024
·
Fei Ni
DBLP profile ↗
ORCID search ↗
PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning
AAAI 2024
·
Jizhou Wu
DBLP profile ↗
ORCID search ↗
The MMO Economist: AI Empowers Robust, Healthy, and Sustainable P2W MMO Economies
WWW 2024
·
Shiwei Zhao
DBLP profile ↗
ORCID search ↗
Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback
ICLR 2024
·
Yifu Yuan
DBLP profile ↗
ORCID search ↗
Unlock the Intermittent Control Ability of Model Free Reinforcement Learning
NeurIPS 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Value-Evolutionary-Based Reinforcement Learning
ICML 2024
·
Pengyi Li
DBLP profile ↗
ORCID search ↗