PPaperPicks

Mingyu Ding

27 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ARCHE: A Novel Task to Evaluate LLMs on Latent Reasoning Chain Extraction
  2. Unlocking the Power of Large Multimodal Models for Robot Learning: Robustness, Generalization, and Opportunities
    AAAI 2026 · Mingyu Ding
  3. CompGS: Unleashing 2D Compositionality for Compositional Text-to-3D via Dynamically Optimizing 3D Gaussians
  4. DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation
  5. Embodiment-agnostic Action Planning via Object-Part Scene Flow
  6. MJ-Video: Benchmarking and Rewarding Video Generation with Fine-Grained Video Preference
  7. MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
  8. Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos
  9. P2 Explore: Efficient Exploration in Unknown Cluttered Environment with Floor Plan Prediction
  10. PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models
  11. Physics-Aware Robotic Palletization With Online Masking Inference
  12. ReBot: Scaling Robot Learning with Real-to-Sim-to-Real Robotic Video Synthesis
  13. RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins
  14. TrajSSL: Trajectory-Enhanced Semi-Supervised 3D Object Detection
  15. WOMD-Reasoning: A Large-Scale Dataset for Interaction Reasoning in Driving
  16. X-Drive: Cross-modality Consistent Multi-Sensor Data Synthesis for Driving Scenarios
  17. DSLO: Deep Sequence LiDAR Odometry Based on Inconsistent Spatio-temporal Propagation
  18. Human-oriented Representation Learning for Robotic Manipulation
  19. Interfacing Foundation Models' Embeddings
  20. MoLE: Enhancing Human-centric Text-to-image Diffusion via Mixture of Low-rank Experts
  21. Open X-Embodiment: Robotic Learning Datasets and RT-X Models : Open X-Embodiment Collaboration
  22. Pre-training on Synthetic Driving Data for Trajectory Prediction
  23. RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis
  24. SkillDiffuser: Interpretable Hierarchical Planning via Skill Abstractions in Diffusion-Based Task Execution
  25. Tree-Planner: Efficient Close-loop Task Planning with Large Language Models
  26. UniAdapter: Unified Parameter-Efficient Transfer Learning for Cross-modal Modeling
  27. VDT: General-purpose Video Diffusion Transformers via Mask Modeling