PPaperPicks

Jianye Hao

88 papers at tracked venues · 76 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AFE-Master: Enhancing LLM-Driven Autonomous Feature Engineering with Domain-Specific Language Parsing and Guided Local Search
  2. AgentSwift: Efficient LLM Agent Design via Value-Guided Hierarchical Search
  3. 3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
  4. A Graph Enhanced Symbolic Discovery Framework For Efficient Logic Optimization
  5. Accelerating Large Language Model Reasoning via Speculative Search
  6. Accurate KV Cache Eviction via Anchor Direction Projection for Efficient LLM Inference
  7. Apollo-MILP: An Alternating Prediction-Correction Neural Solving Framework for Mixed-Integer Linear Programming
  8. AttentionPredictor: Temporal Patterns Matter for KV Cache Compression
  9. Benchmarking End-To-End Performance of AI-Based Chip Placement Algorithms
  10. Boosting Multi-Domain Fine-Tuning of Large Language Models through Evolving Interactions between Samples
  11. COLA: Towards Efficient Multi-Objective Reinforcement Learning with Conflict Objective Regularization in Latent Space
  12. CORE: Collaborative Optimization with Reinforcement Learning and Evolutionary Algorithm for Floorplanning
  13. Computing Circuits Optimization via Model-Based Circuit Genetic Evolution
  14. Conditioning Matters: Training Diffusion Policies is Faster Than You Think
  15. CoopRide: Cooperate All Grids in City-Scale Ride-Hailing Dispatching with Multi-Agent Reinforcement Learning
  16. Differentiable Integer Linear Programming
  17. DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agent
  18. DualRAG: A Dual-Process Approach to Integrate Reasoning and Retrieval for Multi-Hop Question Answering
  19. Dynamic Configuration for Cutting Plane Separators via Reinforcement Learning on Incremental Graph
  20. ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
  21. EchoTraffic: Enhancing Traffic Anomaly Understanding with Audio-Visual Insights
  22. Enhancing Graph-based Coordination with Evolutionary Algorithms for Episodic Multi-agent Reinforcement Learning
  23. High-Performance Arithmetic Circuit Optimization via Differentiable Architecture Search
  24. HyperTree Planning: Enhancing LLM Reasoning via Hierarchical Thinking
  25. Improving Generalization in Offline Reinforcement Learning via Latent Distribution Representation Learning
  26. LaMPlace: Learning to Optimize Cross-Stage Metrics in Macro Placement
  27. LaRes: Evolutionary Reinforcement Learning with LLM-based Adaptive Reward Search
  28. Lightweight Neural App Control
  29. LogicTree: Improving Complex Reasoning of LLMs via Instantiated Multi-step Synthetic Logical Data
  30. MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
  31. OptiTree: Hierarchical Thoughts Generation with Tree Search for LLM Optimization Modeling
  32. R*: Efficient Reward Design via Reward Structure Evolution and Parameter Alignment Optimization with Large Language Models
  33. Reinforced In-Context Black-Box Optimization
  34. RoboAnnotatorX: A Comprehensive and Universal Annotation Framework for Accurate Understanding of Long-Horizon Robot Demonstration
  35. STAR: Learning Diverse Robot Skill Abstractions through Rotation-Augmented Vector Quantization
  36. SWAMamba: A Sliding Window Attention Mamba Framework for Predicting Translation Elongation Rates
  37. SheetAgent: Towards a Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
  38. Spa-Bench: a comprehensive Benchmark for Smartphone Agent Evaluation
  39. Spatial-Temporal Graph Diffusion Policy with Kinematic Modeling for Bimanual Robotic Manipulation
  40. Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control
  41. The Graph's Apprentice: Teaching an LLM Low-Level Knowledge for Circuit Quality Estimation
  42. Trajectory World Models for Heterogeneous Environments
  43. Uncertainty-quantified Rollout Policy Adaptation for Unlabelled Cross-domain Video Temporal Grounding
  44. War of Thoughts: Competition Stimulates Stronger Reasoning in Large Language Models
  45. A Circuit Domain Generalization Framework for Efficient Logic Synthesis in Chip Design
  46. A Hierarchical Adaptive Multi-Task Reinforcement Learning Framework for Multiplier Circuit Design
  47. A Trajectory Perspective on the Role of Data Sampling Techniques in Offline Reinforcement Learning
  48. A Transfer Approach Using Graph Neural Networks in Deep Reinforcement Learning
  49. AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
  50. CleanDiffuser: An Easy-to-use Modularized Library for Diffusion Models in Decision Making
  51. DiffuserLite: Towards Real-time Diffusion Planning
  52. DyPS: Dynamic Parameter Sharing in Multi-Agent Reinforcement Learning for Spatio-Temporal Resource Allocation
  53. ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
  54. ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
  55. EWEK-QA : Enhanced Web and Efficient Knowledge Graph Retrieval for Citation-based Question Answering Systems
  56. EvoRainbow: Combining Improvements in Evolutionary Reinforcement Learning for Policy Search
  57. FlexPlanner: Flexible 3D Floorplanning via Deep Reinforcement Learning in Hybrid Action Space with Multi-Modality Representation
  58. Generate Subgoal Images Before Act: Unlocking the Chain-of-Thought Reasoning in Diffusion Model for Robot Manipulation with Multimodal Prompts
  59. GraSS: Combining Graph Neural Networks with Expert Knowledge for SAT Solver Selection
  60. HarmonyDream: Task Harmonization Inside World Models
  61. Hybrid CtrlFormer: Learning Adaptive Search Space Partition for Hybrid Action Control via Transformer-based Monte Carlo Tree Search
  62. Improving Generalization in Offline Reinforcement Learning via Adversarial Data Splitting
  63. Improving Unsupervised Hierarchical Representation With Reinforcement Learning
  64. Iteratively Refined Behavior Regularization for Offline Reinforcement Learning
  65. KISA: A Unified Keyframe Identifier and Skill Annotator for Long-Horizon Robotics Demonstrations
  66. Multiagent Gumbel MuZero: Efficient Planning in Combinatorial Action Spaces
  67. OVD-Explorer: Optimism Should Not Be the Sole Pursuit of Exploration in Noisy Environments
  68. PADDLE: Logic Program Guided Policy Reuse in Deep Reinforcement Learning
  69. PERIA: Perceive, Reason, Imagine, Act via Holistic Language and Vision Planning for Manipulation
  70. PORTAL: Automatic Curricula Generation for Multiagent Reinforcement Learning
  71. PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling
  72. Reinforcement Learning within Tree Search for Fast Macro Placement
  73. Rethinking Branching on Exact Combinatorial Optimization Solver: The First Deep Symbolic Discovery Framework
  74. Rethinking Decision Transformer via Hierarchical Reinforcement Learning
  75. Safe Table Tennis Swing Stroke with Low-Cost Hardware
  76. Sample-Efficient Multiagent Reinforcement Learning with Reset Replay
  77. Sample-Efficient Quality-Diversity by Cooperative Coevolution
  78. The Ladder in Chaos: Improving Policy Learning by Harnessing the Parameter Evolving Path in A Low-dimensional Space
  79. The MMO Economist: AI Empowers Robust, Healthy, and Sustainable P2W MMO Economies
  80. Towards General Algorithm Discovery for Combinatorial Optimization: Learning Symbolic Branching Policy from Bipartite Graph
  81. Towards Next-Generation Logic Synthesis: A Scalable Neural Circuit Generation Framework
  82. Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback
  83. Unlock the Cognitive Generalization of Deep Reinforcement Learning via Granular Ball Representation
  84. Unlock the Intermittent Control Ability of Model Free Reinforcement Learning
  85. Value-Evolutionary-Based Reinforcement Learning
  86. iVideoGPT: Interactive VideoGPTs are Scalable World Models
  87. vMFER: Von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement
  88. vMFER: von Mises-Fisher Experience Resampling Based on Uncertainty of Gradient Directions for Policy Improvement of Actor-Critic Algorithms