P
PaperPicks
Conferences
Jing Huo
17 papers at tracked venues · 14 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-8504-455X ↗
Homepage ↗
Venues
ICLR
×5
ACL
×3
AAAI
×2
CVPR
×2
NeurIPS
×2
AAMAS
×1
ECAI
×1
PPSN
×1
Frequent coauthors
Hongye Cao
DBLP profile ↗
ORCID search ↗
×3
Zixuan Chen
DBLP profile ↗
ORCID search ↗
×3
Quanlin Chen
DBLP profile ↗
ORCID search ↗
×2
Kai Chen
DBLP profile ↗
ORCID search ↗
×1
Siyuan Gan
DBLP profile ↗
ORCID search ↗
×1
Xikang Guan
DBLP profile ↗
ORCID search ↗
×1
Yiyang Chen
DBLP profile ↗
ORCID search ↗
×1
Yangtao Chen
DBLP profile ↗
ORCID search ↗
×1
Mingzhi Wang
DBLP profile ↗
ORCID search ↗
×1
Guang Yang
DBLP profile ↗
ORCID search ↗
×1
Wenxiao Deng
DBLP profile ↗
ORCID search ↗
×1
Yanqi Bao
DBLP profile ↗
ORCID search ↗
×1
Papers
Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning
AAAI 2026
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
MDTeamGPT: Mitigating Context Collapse and Enabling Self-Evolution in Medical Multi-Agent Reasoning
ACL 2026
·
Kai Chen
DBLP profile ↗
ORCID search ↗
ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation
AAAI 2026
·
Zixuan Chen
DBLP profile ↗
ORCID search ↗
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
ACL 2026
·
Siyuan Gan
DBLP profile ↗
ORCID search ↗
Causal Information Prioritization for Efficient Reinforcement Learning
ICLR 2025
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
CoT-VTM: Visual-to-Music Generation with Chain-of-Thought Reasoning
ACL 2025
·
Xikang Guan
DBLP profile ↗
ORCID search ↗
Enhancing Few-Shot Class-Incremental Learning via Training-Free Bi-Level Modality Calibration
CVPR 2025
·
Yiyang Chen
DBLP profile ↗
ORCID search ↗
Enhancing Trust-Region Bayesian Optimization via Newton Methods
ECAI 2025
·
Quanlin Chen
DBLP profile ↗
ORCID search ↗
GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D Manipulation
ICLR 2025
·
Yangtao Chen
DBLP profile ↗
ORCID search ↗
Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
ICLR 2025
·
Mingzhi Wang
DBLP profile ↗
ORCID search ↗
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
NeurIPS 2025
·
Guang Yang
DBLP profile ↗
ORCID search ↗
Towards Empowerment Gain through Causal Structure Learning in Model-Based Reinforcement Learning
ICLR 2025
·
Hongye Cao
DBLP profile ↗
ORCID search ↗
Cognizing and Imitating Robotic Skills via a Dual Cognition-Action Architecture
AAMAS 2024
·
Zixuan Chen
DBLP profile ↗
ORCID search ↗
Exploiting Inter-sample and Inter-feature Relations in Dataset Distillation
CVPR 2024
·
Wenxiao Deng
DBLP profile ↗
ORCID search ↗
InsertNeRF: Instilling Generalizability into NeRF with HyperNet Modules
ICLR 2024
·
Yanqi Bao
DBLP profile ↗
ORCID search ↗
Re-examining Supervised Dimension Reduction for High-Dimensional Bayesian Optimization
PPSN 2024
·
Quanlin Chen
DBLP profile ↗
ORCID search ↗
SCaR: Refining Skill Chaining for Long-Horizon Robotic Manipulation via Dual Regularization
NeurIPS 2024
·
Zixuan Chen
DBLP profile ↗
ORCID search ↗