P
PaperPicks
Conferences
Chenjia Bai
29 papers at tracked venues · 24 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-8379-9385 ↗
Homepage ↗
Venues
NeurIPS
×9
ICML
×6
AAAI
×4
ICLR
×3
ACL
×2
IROS
×2
ECAI
×1
EMNLP
×1
ICRA
×1
Frequent coauthors
Jiyuan Shi
DBLP profile ↗
ORCID search ↗
×2
Weiji Xie
DBLP profile ↗
ORCID search ↗
×2
Ting Xiao
DBLP profile ↗
ORCID search ↗
×2
Yang Zhang
DBLP profile ↗
ORCID search ↗
×2
Jiafei Lyu
DBLP profile ↗
ORCID search ↗
×2
Yingnan Zhao
DBLP profile ↗
ORCID search ↗
×1
Haofu Qian
DBLP profile ↗
ORCID search ↗
×1
Xinran Li
DBLP profile ↗
ORCID search ↗
×1
Zhao Shan
DBLP profile ↗
ORCID search ↗
×1
Zhi Jing
DBLP profile ↗
ORCID search ↗
×1
Liyuan Mao
DBLP profile ↗
ORCID search ↗
×1
Xinyi Yuan
DBLP profile ↗
ORCID search ↗
×1
Papers
Towards Adaptive Humanoid Control via Multi-Behavior Distillation and Reinforced Fine-Tuning
AAAI 2026
·
Yingnan Zhao
DBLP profile ↗
ORCID search ↗
Adversarial Locomotion and Motion Imitation for Humanoid Policy Learning
NeurIPS 2025
·
Jiyuan Shi
DBLP profile ↗
ORCID search ↗
Discriminator-Guided Embodied Planning for LLM Agent
ICLR 2025
·
Haofu Qian
DBLP profile ↗
ORCID search ↗
Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
ICLR 2025
·
Xinran Li
DBLP profile ↗
ORCID search ↗
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies
AAAI 2025
·
Zhao Shan
DBLP profile ↗
ORCID search ↗
Humanoid Whole-Body Locomotion on Narrow Terrain via Dynamic Balance and Reinforcement Learning
IROS 2025
·
Weiji Xie
DBLP profile ↗
ORCID search ↗
HumanoidGen: Data Generation for Bimanual Dexterous Manipulation via LLM Reasoning
NeurIPS 2025
·
Zhi Jing
DBLP profile ↗
ORCID search ↗
Information-Theoretic Reward Decomposition for Generalizable RLHF
NeurIPS 2025
·
Liyuan Mao
DBLP profile ↗
ORCID search ↗
KungfuBot: Physics-Based Humanoid Whole-Body Control for Learning Highly-Dynamic Skills
NeurIPS 2025
·
Weiji Xie
DBLP profile ↗
ORCID search ↗
Online Iterative Self-Alignment for Radiology Report Generation
ACL 2025
·
Ting Xiao
DBLP profile ↗
ORCID search ↗
Online Preference Alignment for Language Models via Count-based Exploration
ICLR 2025
·
Chenjia Bai
Preference Aligned Diffusion Planner for Quadrupedal Locomotion Control
IROS 2025
·
Xinyi Yuan
DBLP profile ↗
ORCID search ↗
Radiology Report Generation via Multi-objective Preference Optimization
AAAI 2025
·
Ting Xiao
DBLP profile ↗
ORCID search ↗
Revisiting Multi-Agent World Modeling from a Diffusion-Inspired Perspective
NeurIPS 2025
·
Yang Zhang
DBLP profile ↗
ORCID search ↗
Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
ICML 2025
·
Chenyou Fan
DBLP profile ↗
ORCID search ↗
Towards Efficient LLM Grounding for Embodied Multi-Agent Collaboration
ACL 2025
·
Yang Zhang
DBLP profile ↗
ORCID search ↗
Towards Reliable LLM-based Robots Planning via Combined Uncertainty Estimation
NeurIPS 2025
·
Shiyuan Yin
DBLP profile ↗
ORCID search ↗
VLP: Vision-Language Preference Learning for Embodied Manipulation
EMNLP 2025
·
Runze Liu
DBLP profile ↗
ORCID search ↗
Constrained Ensemble Exploration for Unsupervised Skill Discovery
ICML 2024
·
Chenjia Bai
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
ICML 2024
·
Xiaoyu Wen
DBLP profile ↗
ORCID search ↗
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
ICML 2024
·
Jiafei Lyu
DBLP profile ↗
ORCID search ↗
How Does Goal Relabeling Improve Sample Efficiency?
ICML 2024
·
Sirui Zheng
DBLP profile ↗
ORCID search ↗
Learning an Actionable Discrete Diffusion Policy via Large-Scale Actionless Video Pre-Training
NeurIPS 2024
·
Haoran He
DBLP profile ↗
ORCID search ↗
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
NeurIPS 2024
·
Jiafei Lyu
DBLP profile ↗
ORCID search ↗
OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments
AAAI 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
Regularized Conditional Diffusion Model for Multi-Task Preference Alignment
NeurIPS 2024
·
Xudong Yu
DBLP profile ↗
ORCID search ↗
Robust Quadrupedal Locomotion via Risk-Averse Policy Learning
ICRA 2024
·
Jiyuan Shi
DBLP profile ↗
ORCID search ↗
SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation
ICML 2024
·
Junjie Zhang
DBLP profile ↗
ORCID search ↗
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
ECAI 2024
·
Shirong Liu
DBLP profile ↗
ORCID search ↗