P
PaperPicks
Conferences
Jianye Hao
88 papers at tracked venues · 76 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-0422-8235 ↗
Homepage ↗
Venues
NeurIPS
×22
ICML
×19
ICLR
×13
AAAI
×8
AAMAS
×5
CVPR
×4
IJCAI
×4
ACL
×3
SIGKDD
×3
WWW
×3
ICCV
×1
ICRA
×1
IROS
×1
UAI
×1
Frequent coauthors
Zhihai Wang
DBLP profile ↗
ORCID search ↗
×6
Pengyi Li
DBLP profile ↗
ORCID search ↗
×6
Zijie Geng
DBLP profile ↗
ORCID search ↗
×4
Zibin Dong
DBLP profile ↗
ORCID search ↗
×4
Jiashun Liu
DBLP profile ↗
ORCID search ↗
×3
Haoyang Liu
DBLP profile ↗
ORCID search ↗
×2
Jingwei Wang
DBLP profile ↗
ORCID search ↗
×2
Da Wang
DBLP profile ↗
ORCID search ↗
×2
Yifu Yuan
DBLP profile ↗
ORCID search ↗
×2
Longxin Kou
DBLP profile ↗
ORCID search ↗
×2
Yibin Chen
DBLP profile ↗
ORCID search ↗
×2
Jinyi Liu
DBLP profile ↗
ORCID search ↗
×2
Papers
AFE-Master: Enhancing LLM-Driven Autonomous Feature Engineering with Domain-Specific Language Parsing and Guided Local Search
WWW 2026
·
Hebin Liang
DBLP profile ↗
ORCID search ↗
AgentSwift: Efficient LLM Agent Design via Value-Guided Hierarchical Search
AAAI 2026
·
Yu Li
DBLP profile ↗
ORCID search ↗
3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
ICLR 2025
·
Hengshuo Chu
DBLP profile ↗
ORCID search ↗
A Graph Enhanced Symbolic Discovery Framework For Efficient Logic Optimization
ICLR 2025
·
Yinqi Bai
DBLP profile ↗
ORCID search ↗
Accelerating Large Language Model Reasoning via Speculative Search
ICML 2025
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
Accurate KV Cache Eviction via Anchor Direction Projection for Efficient LLM Inference
NeurIPS 2025
·
Zijie Geng
DBLP profile ↗
ORCID search ↗
Apollo-MILP: An Alternating Prediction-Correction Neural Solving Framework for Mixed-Integer Linear Programming
ICLR 2025
·
Haoyang Liu
DBLP profile ↗
ORCID search ↗
AttentionPredictor: Temporal Patterns Matter for KV Cache Compression
NeurIPS 2025
·
Qingyue Yang
DBLP profile ↗
ORCID search ↗
Benchmarking End-To-End Performance of AI-Based Chip Placement Algorithms
NeurIPS 2025
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
Boosting Multi-Domain Fine-Tuning of Large Language Models through Evolving Interactions between Samples
ICML 2025
·
Xize Liang
DBLP profile ↗
ORCID search ↗
COLA: Towards Efficient Multi-Objective Reinforcement Learning with Conflict Objective Regularization in Latent Space
NeurIPS 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
CORE: Collaborative Optimization with Reinforcement Learning and Evolutionary Algorithm for Floorplanning
NeurIPS 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
Computing Circuits Optimization via Model-Based Circuit Genetic Evolution
ICLR 2025
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
Conditioning Matters: Training Diffusion Policies is Faster Than You Think
NeurIPS 2025
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
CoopRide: Cooperate All Grids in City-Scale Ride-Hailing Dispatching with Multi-Agent Reinforcement Learning
SIGKDD 2025
·
Jingwei Wang
DBLP profile ↗
ORCID search ↗
Differentiable Integer Linear Programming
ICLR 2025
·
Zijie Geng
DBLP profile ↗
ORCID search ↗
DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agent
ICLR 2025
·
Taiyi Wang
DBLP profile ↗
ORCID search ↗
DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
ACL 2025
·
Rong Cheng
DBLP profile ↗
ORCID search ↗
Dynamic Configuration for Cutting Plane Separators via Reinforcement Learning on Incremental Graph
NeurIPS 2025
·
Mingxuan Ye
DBLP profile ↗
ORCID search ↗
ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
IROS 2025
·
Lingfeng Zhang
DBLP profile ↗
ORCID search ↗
EchoTraffic: Enhancing Traffic Anomaly Understanding with Audio-Visual Insights
CVPR 2025
·
Zhenghao Xing
DBLP profile ↗
ORCID search ↗
Enhancing Graph-based Coordination with Evolutionary Algorithms for Episodic Multi-agent Reinforcement Learning
AAMAS 2025
·
Kexing Peng
DBLP profile ↗
ORCID search ↗
High-Performance Arithmetic Circuit Optimization via Differentiable Architecture Search
NeurIPS 2025
·
Xilin Xia
DBLP profile ↗
ORCID search ↗
HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
ICML 2025
·
Runquan Gui
DBLP profile ↗
ORCID search ↗
Improving Generalization in Offline Reinforcement Learning via Latent Distribution Representation Learning
AAAI 2025
·
Da Wang
DBLP profile ↗
ORCID search ↗
LaMPlace: Learning to Optimize Cross-Stage Metrics in Macro Placement
ICLR 2025
·
Zijie Geng
DBLP profile ↗
ORCID search ↗
LaRes: Evolutionary Reinforcement Learning with LLM-based Adaptive Reward Search
NeurIPS 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
Lightweight Neural App Control
ICLR 2025
·
Filippos Christianos
DBLP profile ↗
ORCID search ↗
LogicTree: Improving Complex Reasoning of LLMs via Instantiated Multi-step Synthetic Logical Data
NeurIPS 2025
·
Zehao Wang
DBLP profile ↗
ORCID search ↗
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
ICML 2025
·
Yifu Yuan
DBLP profile ↗
ORCID search ↗
OptiTree: Hierarchical Thoughts Generation with Tree Search for LLM Optimization Modeling
NeurIPS 2025
·
Haoyang Liu
DBLP profile ↗
ORCID search ↗
R*: Efficient Reward Design via Reward Structure Evolution and Parameter Alignment Optimization with Large Language Models
ICML 2025
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
Reinforced In-Context Black-Box Optimization
IJCAI 2025
·
Lei Song
DBLP profile ↗
ORCID search ↗
RoboAnnotatorX: A Comprehensive and Universal Annotation Framework for Accurate Understanding of Long-Horizon Robot Demonstration
ICCV 2025
·
Longxin Kou
DBLP profile ↗
ORCID search ↗
STAR: Learning Diverse Robot Skill Abstractions through Rotation-Augmented Vector Quantization
ICML 2025
·
Hao Li
DBLP profile ↗
ORCID search ↗
SWAMamba: A Sliding Window Attention Mamba Framework for Predicting Translation Elongation Rates
AAAI 2025
·
Xi Zeng
DBLP profile ↗
ORCID search ↗
SheetAgent: Towards a Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
WWW 2025
·
Yibin Chen
DBLP profile ↗
ORCID search ↗
Spa-Bench: a comprehensive Benchmark for Smartphone Agent Evaluation
ICLR 2025
·
Jingxuan Chen
DBLP profile ↗
ORCID search ↗
Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation
CVPR 2025
·
Qi Lv
DBLP profile ↗
ORCID search ↗
Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control
NeurIPS 2025
·
Georgios Papoudakis
DBLP profile ↗
ORCID search ↗
The Graph's Apprentice: Teaching an LLM Low-Level Knowledge for Circuit Quality Estimation
IJCAI 2025
·
Reza Moravej
DBLP profile ↗
ORCID search ↗
Trajectory World Models for Heterogeneous Environments
ICML 2025
·
Shaofeng Yin
DBLP profile ↗
ORCID search ↗
Uncertainty-quantified Rollout Policy Adaptation for Unlabelled Cross-domain Video Temporal Grounding
NeurIPS 2025
·
Jian Hu
DBLP profile ↗
ORCID search ↗
War of Thoughts: Competition Stimulates Stronger Reasoning in Large Language Models
ACL 2025
·
Yibin Chen
DBLP profile ↗
ORCID search ↗
A Circuit Domain Generalization Framework for Efficient Logic Synthesis in Chip Design
ICML 2024
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
A Hierarchical Adaptive Multi-Task Reinforcement Learning Framework for Multiplier Circuit Design
ICML 2024
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
A Trajectory Perspective on the Role of Data Sampling Techniques in Offline Reinforcement Learning
AAMAS 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
A Transfer Approach Using Graph Neural Networks in Deep Reinforcement Learning
AAAI 2024
·
Tianpei Yang
DBLP profile ↗
ORCID search ↗
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
ICLR 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making
NeurIPS 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
DiffuserLite: Towards Real-time Diffusion Planning
NeurIPS 2024
·
Zibin Dong
DBLP profile ↗
ORCID search ↗
DyPS: Dynamic Parameter Sharing in Multi-Agent Reinforcement Learning for Spatio-Temporal Resource Allocation
SIGKDD 2024
·
Jingwei Wang
DBLP profile ↗
ORCID search ↗
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
AAMAS 2024
·
Kai Zhao
DBLP profile ↗
ORCID search ↗
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
IJCAI 2024
·
Kai Zhao
DBLP profile ↗
ORCID search ↗
EWEK-QA : Enhanced Web and Efficient Knowledge Graph Retrieval for Citation-based Question Answering Systems
ACL 2024
·
Mohammad Dehghan
DBLP profile ↗
ORCID search ↗
EvoRainbow: Combining Improvements in Evolutionary Reinforcement Learning for Policy Search
ICML 2024
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
FlexPlanner: Flexible 3D Floorplanning via Deep Reinforcement Learning in Hybrid Action Space with Multi-Modality Representation
NeurIPS 2024
·
Ruizhe Zhong
DBLP profile ↗
ORCID search ↗
Generate Subgoal Images Before Act: Unlocking the Chain-of-Thought Reasoning in Diffusion Model for Robot Manipulation with Multimodal Prompts
CVPR 2024
·
Fei Ni
DBLP profile ↗
ORCID search ↗
GraSS: Combining Graph Neural Networks with Expert Knowledge for SAT Solver Selection
SIGKDD 2024
·
Zhanguang Zhang
DBLP profile ↗
ORCID search ↗
HarmonyDream: Task Harmonization Inside World Models
ICML 2024
·
Haoyu Ma
DBLP profile ↗
ORCID search ↗
Hybrid CtrlFormer: Learning Adaptive Search Space Partition for Hybrid Action Control via Transformer-based Monte Carlo Tree Search
UAI 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Improving Generalization in Offline Reinforcement Learning via Adversarial Data Splitting
ICML 2024
·
Da Wang
DBLP profile ↗
ORCID search ↗
Improving Unsupervised Hierarchical Representation With Reinforcement Learning
CVPR 2024
·
Ruyi An
DBLP profile ↗
ORCID search ↗
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
NeurIPS 2024
·
Yi Ma
DBLP profile ↗
ORCID search ↗
KISA: A Unified Keyframe Identifier and Skill Annotator for Long-Horizon Robotics Demonstrations
ICML 2024
·
Longxin Kou
DBLP profile ↗
ORCID search ↗
Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces
AAAI 2024
·
Xiaotian Hao
DBLP profile ↗
ORCID search ↗
OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments
AAAI 2024
·
Jinyi Liu
DBLP profile ↗
ORCID search ↗
PADDLE: Logic Program Guided Policy Reuse in Deep Reinforcement Learning
AAMAS 2024
·
Hao Zhang
DBLP profile ↗
ORCID search ↗
PERIA: Perceive, Reason, Imagine, Act via Holistic Language and Vision Planning for Manipulation
NeurIPS 2024
·
Fei Ni
DBLP profile ↗
ORCID search ↗
PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning
AAAI 2024
·
Jizhou Wu
DBLP profile ↗
ORCID search ↗
PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling
AAAI 2024
·
Ruizhe Zhong
DBLP profile ↗
ORCID search ↗
Reinforcement Learning within Tree Search for Fast Macro Placement
ICML 2024
·
Zijie Geng
DBLP profile ↗
ORCID search ↗
Rethinking Branching on Exact Combinatorial Optimization Solver: The First Deep Symbolic Discovery Framework
ICLR 2024
·
Yufei Kuang
DBLP profile ↗
ORCID search ↗
Rethinking Decision Transformer via Hierarchical Reinforcement Learning
ICML 2024
·
Yi Ma
DBLP profile ↗
ORCID search ↗
Safe Table Tennis Swing Stroke with Low-Cost Hardware
ICRA 2024
·
Francesco Cursi
DBLP profile ↗
ORCID search ↗
Sample-Efficient Multiagent Reinforcement Learning with Reset Replay
ICML 2024
·
Yaodong Yang
DBLP profile ↗
ORCID search ↗
Sample-Efficient Quality-Diversity by Cooperative Coevolution
ICLR 2024
·
Ke Xue
DBLP profile ↗
ORCID search ↗
The Ladder in Chaos: Improving Policy Learning by Harnessing the Parameter Evolving Path in A Low-dimensional Space
NeurIPS 2024
·
Hongyao Tang
DBLP profile ↗
ORCID search ↗
The MMO Economist: AI Empowers Robust, Healthy, and Sustainable P2W MMO Economies
WWW 2024
·
Shiwei Zhao
DBLP profile ↗
ORCID search ↗
Towards General Algorithm Discovery for Combinatorial Optimization: Learning Symbolic Branching Policy from Bipartite Graph
ICML 2024
·
Yufei Kuang
DBLP profile ↗
ORCID search ↗
Towards Next-Generation Logic Synthesis: A Scalable Neural Circuit Generation Framework
NeurIPS 2024
·
Zhihai Wang
DBLP profile ↗
ORCID search ↗
Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback
ICLR 2024
·
Yifu Yuan
DBLP profile ↗
ORCID search ↗
Unlock the Cognitive Generalization of Deep Reinforcement Learning via Granular Ball Representation
ICML 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Unlock the Intermittent Control Ability of Model Free Reinforcement Learning
NeurIPS 2024
·
Jiashun Liu
DBLP profile ↗
ORCID search ↗
Value-Evolutionary-Based Reinforcement Learning
ICML 2024
·
Pengyi Li
DBLP profile ↗
ORCID search ↗
iVideoGPT: Interactive VideoGPTs are Scalable World Models
NeurIPS 2024
·
Jialong Wu
DBLP profile ↗
ORCID search ↗
vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
IJCAI 2024
·
Yiwen Zhu
DBLP profile ↗
ORCID search ↗
vMFER: von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement of Actor-Critic Algorithms
AAMAS 2024
·
Yiwen Zhu
DBLP profile ↗
ORCID search ↗