PPaperPicks

Chenjia Bai

29 papers at tracked venues · 24 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Towards Adaptive Humanoid Control via Multi-Behavior Distillation and Reinforced Fine-Tuning
  2. Adversarial Locomotion and Motion Imitation for Humanoid Policy Learning
  3. Discriminator-Guided Embodied Planning for LLM Agent
  4. Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
  5. Forward KL Regularized Preference Optimization for Aligning Diffusion Policies
  6. Humanoid Whole-Body Locomotion on Narrow Terrain via Dynamic Balance and Reinforcement Learning
  7. HumanoidGen: Data Generation for Bimanual Dexterous Manipulation via LLM Reasoning
  8. Information-Theoretic Reward Decomposition for Generalizable RLHF
  9. KungfuBot: Physics-Based Humanoid Whole-Body Control for Learning Highly-Dynamic Skills
  10. Online Iterative Self-Alignment for Radiology Report Generation
  11. Online Preference Alignment for Language Models via Count-based Exploration
    ICLR 2025 · Chenjia Bai
  12. Preference Aligned Diffusion Planner for Quadrupedal Locomotion Control
  13. Radiology Report Generation via Multi-objective Preference Optimization
  14. Revisiting Multi-Agent World Modeling from a Diffusion-Inspired Perspective
  15. Task-Agnostic Pre-training and Task-Guided Fine-tuning for Versatile Diffusion Planner
  16. Towards Efficient LLM Grounding for Embodied Multi-Agent Collaboration
  17. Towards Reliable LLM-based Robots Planning via Combined Uncertainty Estimation
  18. VLP: Vision-Language Preference Learning for Embodied Manipulation
  19. Constrained Ensemble Exploration for Unsupervised Skill Discovery
    ICML 2024 · Chenjia Bai
  20. Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
  21. Cross-Domain Policy Adaptation by Capturing Representation Mismatch
  22. How Does Goal Relabeling Improve Sample Efficiency?
  23. Learning an Actionable Discrete Diffusion Policy via Large-Scale Actionless Video Pre-Training
  24. ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
  25. OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments
  26. Regularized Conditional Diffusion Model for Multi-Task Preference Alignment
  27. Robust Quadrupedal Locomotion via Risk-Averse Policy Learning
  28. SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation
  29. SelfBC: Self Behavior Cloning for Offline Reinforcement Learning