P
PaperPicks
Conferences
Chao Yu
15 papers at tracked venues · 8 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
ICML
×4
NeurIPS
×3
ICRA
×2
IROS
×2
AAAI
×1
AAMAS
×1
CIKM
×1
EMNLP
×1
Frequent coauthors
Zelai Xu
DBLP profile ↗
ORCID search ↗
×3
Jijia Liu
DBLP profile ↗
ORCID search ↗
×3
Shusheng Xu
DBLP profile ↗
ORCID search ↗
×2
Jinwei Zeng
DBLP profile ↗
ORCID search ↗
×1
Weizheng Wang
DBLP profile ↗
ORCID search ↗
×1
Yutao Ouyang
DBLP profile ↗
ORCID search ↗
×1
Yuqing Xie
DBLP profile ↗
ORCID search ↗
×1
Tonghe Zhang
DBLP profile ↗
ORCID search ↗
×1
Songsheng Wang
DBLP profile ↗
ORCID search ↗
×1
Jiayu Chen
DBLP profile ↗
ORCID search ↗
×1
Papers
CityLight: A Neighborhood-inclusive Universal Model for Coordinated City-scale Traffic Signal Control
CIKM 2025
·
Jinwei Zeng
DBLP profile ↗
ORCID search ↗
Human-Robot Cooperative Distribution Coupling for Hamiltonian-Constrained Social Navigation
ICRA 2025
·
Weizheng Wang
DBLP profile ↗
ORCID search ↗
Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization
ICML 2025
·
Zelai Xu
DBLP profile ↗
ORCID search ↗
Learning from Suboptimal Data in Continuous Control via Auto-Regressive Soft Q-Network
ICML 2025
·
Jijia Liu
DBLP profile ↗
ORCID search ↗
Long-horizon Locomotion and Manipulation on a Quadrupedal Robot with Large Language Models
IROS 2025
·
Yutao Ouyang
DBLP profile ↗
ORCID search ↗
Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning
IROS 2025
·
Yuqing Xie
DBLP profile ↗
ORCID search ↗
ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning
NeurIPS 2025
·
Tonghe Zhang
DBLP profile ↗
ORCID search ↗
Spec-VLA: Speculative Decoding for Vision-Language-Action Models with Relaxed Acceptance
EMNLP 2025
·
Songsheng Wang
DBLP profile ↗
ORCID search ↗
VolleyBots: A Testbed for Multi-Drone Volleyball Game Combining Motion Control and Strategic Play
NeurIPS 2025
·
Zelai Xu
DBLP profile ↗
ORCID search ↗
What Can RL Bring to VLA Generalization? An Empirical Study
NeurIPS 2025
·
Jijia Liu
DBLP profile ↗
ORCID search ↗
Accelerate Multi-Agent Reinforcement Learning in Zero-Sum Games with Subgame Curriculum Learning
AAAI 2024
·
Jiayu Chen
DBLP profile ↗
ORCID search ↗
Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study
ICML 2024
·
Shusheng Xu
DBLP profile ↗
ORCID search ↗
LAGOON: Language-Guided Motion Control
ICRA 2024
·
Shusheng Xu
DBLP profile ↗
ORCID search ↗
LLM-Powered Hierarchical Language Agent for Real-time Human-AI Coordination
AAMAS 2024
·
Jijia Liu
DBLP profile ↗
ORCID search ↗
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
ICML 2024
·
Zelai Xu
DBLP profile ↗
ORCID search ↗