P
PaperPicks
Conferences
Bo Ding
13 papers at tracked venues · 11 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×2
ICML
×2
SIGIR
×2
ACL
×1
ACM MM
×1
CHI
×1
ICLR
×1
ICRA
×1
IJCAI
×1
NeurIPS
×1
Frequent coauthors
Xudong Gong
DBLP profile ↗
ORCID search ↗
×5
Yuanzhao Zhai
DBLP profile ↗
ORCID search ↗
×4
Yang Shen
DBLP profile ↗
ORCID search ↗
×1
Xiaoying Le
DBLP profile ↗
ORCID search ↗
×1
Xinning Chen
DBLP profile ↗
ORCID search ↗
×1
Tianjiao Wan
DBLP profile ↗
ORCID search ↗
×1
Papers
Divergence or Convergence? A Deep Insight into the Crowd Collaboration and its Productivity in Open Source Software based on Entropy
CHI 2026
·
Yang Shen
DBLP profile ↗
ORCID search ↗
EvoNarrator: Modeling Scientific Evolution for Feasible Hypothesis Generation
ACL 2026
·
Xiaoying Le
DBLP profile ↗
ORCID search ↗
Empowering Large Language Model Agent through Step-Level Self-Critique and Self-Training
SIGIR 2025
·
Yuanzhao Zhai
DBLP profile ↗
ORCID search ↗
Enhancing Decision-Making for LLM Agents via Step-Level Q-Value Models
AAAI 2025
·
Yuanzhao Zhai
DBLP profile ↗
ORCID search ↗
Improving the Continuity of Goal-Achievement Ability via Policy Self-Regularization for Goal-Conditioned Reinforcement Learning
ICML 2025
·
Xudong Gong
DBLP profile ↗
ORCID search ↗
Preference-Strength-Aware Self-Improving Alignment with Generative Preference Models
SIGIR 2025
·
Yuanzhao Zhai
DBLP profile ↗
ORCID search ↗
V-Pilot: A Velocity Vector Control Agent for Fixed-Wing UAVs from Imperfect Demonstrations
ICRA 2025
·
Xudong Gong
DBLP profile ↗
ORCID search ↗
VVC-Gym: A Fixed-Wing UAV Reinforcement Learning Environment for Multi-Goal Long-Horizon Problems
ICLR 2025
·
Xudong Gong
DBLP profile ↗
ORCID search ↗
Goal-Conditioned On-Policy Reinforcement Learning
NeurIPS 2024
·
Xudong Gong
DBLP profile ↗
ORCID search ↗
Iterative Regularized Policy Optimization with Imperfect Demonstrations
ICML 2024
·
Xudong Gong
DBLP profile ↗
ORCID search ↗
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
AAAI 2024
·
Yuanzhao Zhai
DBLP profile ↗
ORCID search ↗
Selective Learning for Sample-Efficient Training in Multi-Agent Sparse Reward Tasks (Extended Abstract)
IJCAI 2024
·
Xinning Chen
DBLP profile ↗
ORCID search ↗
Tracing Training Progress: Dynamic Influence Based Selection for Active Learning
ACM MM 2024
·
Tianjiao Wan
DBLP profile ↗
ORCID search ↗