PPaperPicks

Hao Dong

Peking University, PKU-Agibot Lab, Center on Frontiers of Computing Studies, School of Computer Science, Beijing, China

49 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A3D: Adaptive Affordance Assembly with Dual-Arm Manipulation
  2. Communication-Efficient Desire Alignment for Proactive Embodied Human-Agent Interaction
  3. CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
  4. 3DWG: 3D Weakly Supervised Visual Grounding via Category and Instance-Level Alignment
  5. AdaManip: Adaptive Articulated Object Manipulation Environments and Policy Learning
  6. Adaptive Articulated Object Manipulation on the Fly with Foundation Model Reasoning and Part Grounding
  7. Adaptive Visuo-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation
  8. BiAssemble: Learning Collaborative Affordance for Bimanual Geometric Assembly
  9. CADGrasp: Learning Contact and Collision Aware General Dexterous Grasping in Cluttered Scenes
  10. Canonical Representation and Force-Based Pretraining of 3D Tactile for Dexterous Visuo-Tactile Policy Learning
  11. CheckManual: A New Challenge and Benchmark for Manual-based Appliance Manipulation
  12. DexFlyWheel: A Scalable and Self-improving Data Generation Framework for Dexterous Manipulation
  13. DexGarmentLab: Dexterous Garment Manipulation Environment with Generalizable Policy
  14. Et-Seed: Efficient trajectory-Level SE(3) equivariant diffusion Policy
  15. Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach
  16. GFPack++: Attention-Driven Gradient Fields for Optimizing 2D Irregular Packing
  17. GarmentPile: Point-Level Visual Affordance Guided Retrieval and Adaptation for Cluttered Garments Manipulation
  18. ManipGPT: Is Affordance Segmentation by Large Vision Models Enough for Articulated Object Manipulation?
  19. Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
  20. OmniManip: Towards General Robotic Manipulation via Object-Centric Interaction Primitives as Spatial Constraints
  21. PartRM: Modeling Part-Level Dynamics with Large Cross-State Reconstruction Model
  22. Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation
  23. RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot
  24. SR3D: Unleashing Single-view 3D Reconstruction for Transparent and Specular Object Grasping
  25. SimLauncher: Launching Sample-Efficient Real-World Robotic Reinforcement Learning via Simulation Pre-Training
  26. SpatialBot: Precise Spatial Understanding with Vision Language Models
  27. SplatMesh: Interactive 3D Segmentation and Editing Using Mesh-Based Gaussian Splatting
  28. TransDiff: Diffusion-Based Method for Manipulating Transparent Objects Using a Single RGB-D Image
  29. Articulated Object Manipulation with Coarse-to-fine Affordance for Mitigating the Effect of Point Cloud Noise
  30. Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill
  31. Broadcasting Support Relations Recursively from Local Dynamics for Object Retrieval in Clutters
  32. Discuss Before Moving: Visual Language Navigation via Multi-expert Discussions
  33. GarmentLab: A Unified Simulation and Benchmark for Garment Manipulation
  34. Learning Manipulation by Predicting Interaction
  35. Local Occupancy-Enhanced Object Grasping with Multiple Triplanar Projection
  36. MO-DDN: A Coarse-to-Fine Attribute-based Exploration Agent for Multi-Object Demand-driven Navigation
  37. ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
  38. ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models
  39. No Time to Train: Empowering Non-Parametric Networks for Few-Shot 3D Scene Segmentation
  40. Omni6DPose: A Benchmark and Model for Universal 6D Object Pose Estimation and Tracking
  41. Personalize Segment Anything Model with One Shot
  42. PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
  43. RGBManip: Monocular Image-based Robotic Manipulation through Active Object Pose Estimation
  44. Referred by Multi-Modality: A Unified Temporal Transformer for Video Object Segmentation
  45. RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation
  46. SCANet: Correcting LEGO Assembly Errors with Self-Correct Assembly Network
  47. Scalable Geometric Fracture Assembly via Co-creation Space among Assemblers
  48. SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
  49. UniGarmentManip: A Unified Framework for Category-Level Garment Manipulation via Dense Visual Correspondence