P
PaperPicks
Conferences
Junge Zhang
18 papers at tracked venues · 11 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×6
AAMAS
×3
ACL
×2
IJCAI
×2
CVPR
×1
ECCV
×1
ICCV
×1
ICML
×1
WACV
×1
Frequent coauthors
Xingzhou Lou
DBLP profile ↗
ORCID search ↗
×3
Jing Cui
DBLP profile ↗
ORCID search ↗
×2
Xiaoqian Liu
DBLP profile ↗
ORCID search ↗
×2
Ziqi Wang
DBLP profile ↗
ORCID search ↗
×1
Liang Chen
DBLP profile ↗
ORCID search ↗
×1
Chen Liang
DBLP profile ↗
ORCID search ↗
×1
Yingzhuo Liu
DBLP profile ↗
ORCID search ↗
×1
Sarosij Bose
DBLP profile ↗
ORCID search ↗
×1
Yang Yu
DBLP profile ↗
ORCID search ↗
×1
Shuai Chen
DBLP profile ↗
ORCID search ↗
×1
Hangyu Mao
DBLP profile ↗
ORCID search ↗
×1
Pei Xu
DBLP profile ↗
ORCID search ↗
×1
Papers
Calibration-Aware Policy Optimization for Reasoning LLMs
ACL 2026
·
Ziqi Wang
DBLP profile ↗
ORCID search ↗
Persistent Backdoor Attacks Under Continual Fine-Tuning of LLMs
AAAI 2026
·
Jing Cui
DBLP profile ↗
ORCID search ↗
Distribution Optimization Under Gaussian Hypothesis for Domain Adaptive Semantic Segmentation
WACV 2025
·
Liang Chen
DBLP profile ↗
ORCID search ↗
EPO: Explicit Policy Optimization for Strategic Reasoning in LLMs via Reinforcement Learning
ACL 2025
·
Xiaoqian Liu
DBLP profile ↗
ORCID search ↗
IDEA-Bench: How Far are Generative Models from Professional Designing?
CVPR 2025
·
Chen Liang
DBLP profile ↗
ORCID search ↗
RainbowArena: A Multi-Agent Toolkit for Reinforcement Learning and Large Language Models in Competitive Tabletop Games
AAMAS 2025
·
Yingzhuo Liu
DBLP profile ↗
ORCID search ↗
Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
AAAI 2025
·
Xingzhou Lou
DBLP profile ↗
ORCID search ↗
Uncertainty-Aware Diffusion-Guided Refinement of 3D Scenes
ICCV 2025
·
Sarosij Bose
DBLP profile ↗
ORCID search ↗
ADMN: Agent-Driven Modular Network for Dynamic Parameter Sharing in Cooperative Multi-Agent Reinforcement Learning
IJCAI 2024
·
Yang Yu
DBLP profile ↗
ORCID search ↗
BadRL: Sparse Targeted Backdoor Attack against Reinforcement Learning
AAAI 2024
·
Jing Cui
DBLP profile ↗
ORCID search ↗
Information Bottleneck Based Data Correction in Continual Learning
ECCV 2024
·
Shuai Chen
DBLP profile ↗
ORCID search ↗
NeRF-LiDAR: Generating Realistic LiDAR Point Clouds with Neural Radiance Fields
AAAI 2024
·
Junge Zhang
PDiT: Interleaving Perception and Decision-making Transformers for Deep Reinforcement Learning
AAMAS 2024
·
Hangyu Mao
DBLP profile ↗
ORCID search ↗
Population-Based Diverse Exploration for Sparse-Reward Multi-Agent Tasks
IJCAI 2024
·
Pei Xu
DBLP profile ↗
ORCID search ↗
Position: Foundation Agents as the Paradigm Shift for Decision Making
ICML 2024
·
Xiaoqian Liu
DBLP profile ↗
ORCID search ↗
ProAgent: Building Proactive Cooperative Agents with Large Language Models
AAAI 2024
·
Ceyao Zhang
DBLP profile ↗
ORCID search ↗
Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
AAMAS 2024
·
Xingzhou Lou
DBLP profile ↗
ORCID search ↗
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
AAAI 2024
·
Xingzhou Lou
DBLP profile ↗
ORCID search ↗