PPaperPicks

Yuexin Ma

45 papers at tracked venues · 31 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Models
  2. Can LVLMs Obtain a Driver's License? A Benchmark Towards Reliable AGI for Autonomous Driving
  3. CityAnchor: City-scale 3D Visual Grounding with Multi-modality LLMs
  4. ClimbingCap: Multi-Modal Dataset and Method for Rock Climbing in World Coordinate
  5. DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness
  6. DexH2R: A Benchmark for Dynamic Dexterous Grasping in Human-To-Robot Handover
  7. EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild
  8. Evolvinggrasp: Evolutionary Grasp Generation Via Efficient Preference Alignment
  9. FreeCap: Hybrid Calibration-Free Motion Capture in Open Environments
  10. FreqPolicy: Frequency Autoregressive Visuomotor Policy with Continuous Tokens
  11. Generalizable Single-View Object Pose Estimation by Two-Side Generating and Matching
  12. OccMamba: Semantic Occupancy Prediction with State Space Models
  13. Optimizing Efficiency of Mixed Traffic Through Reinforcement Learning: A Topology-Independent Approach and Benchmark
  14. ReAL-AD: Towards Human-Like Reasoning in End-to-End Autonomous Driving
  15. Renderworld: World Model with Self-Supervised 3D Label
  16. STAGE: A Stream-Centric Generative World Model for Long-Horizon Driving-Scene Simulation
  17. SemGeoMo: Dynamic Contextual Human Motion Generation with Semantic and Geometric Guidance
  18. Towards Immersive Human-X Interaction: A Real-Time Framework for Physically Plausible Motion Synthesis
  19. Towards Label-Free 3D Visual Grounding with Vision Foundation Models
  20. UniDB: A Unified Diffusion Bridge Framework via Stochastic Optimal Control
  21. UniDemoiré: Towards Universal Image Demoiréing with Data Generation and Synthesis
  22. 🎧MOSPA: Human Motion Generation Driven by Spatial Audio
  23. A Unified Framework for Human-centric Point Cloud Video Understanding
  24. ESP: Extro-Spective Prediction for Long-term Behavior Reasoning in Emergency Scenarios
  25. Gait Recognition in Large-scale Free Environment via Single LiDAR
  26. GaussianPro: 3D Gaussian Splatting with Progressive Propagation
  27. GaussianShader: 3D Gaussian Splatting with Shading Functions for Reflective Surfaces
  28. GeoWizard: Unleashing the Diffusion Priors for 3D Geometry Estimation from a Single Image
  29. HUNTER: Unsupervised Human-Centric 3D Detection via Transferring Knowledge from Synthetic Instances to Real Scenes
  30. HybridGait: A Benchmark for Spatial-Temporal Cloth-Changing Gait Recognition with Hybrid Explorations
  31. Learning to Adapt SAM for Segmenting Cross-Domain Point Clouds
  32. LiveHPS++: Robust and Coherent Motion Capture in Dynamic Free Environment
  33. LiveHPS: LiDAR-Based Scene-Level Human Pose and Shape Estimation in Free Environment
  34. Multi-Space Alignments Towards Universal LiDAR Segmentation
  35. NPC: Neural Predictive Control for Fuel-Efficient Autonomous Trucks
  36. OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries
  37. Part2Object: Hierarchical Unsupervised 3D Instance Segmentation
  38. RELI11D: A Comprehensive Multimodal Human Motion Dataset and Method
  39. RealDex: Towards Human-like Grasping for Robotic Dexterous Hand
  40. RoCoSDF: Row-Column Scanned Neural Signed Distance Fields for Freehand 3D Ultrasound Imaging Shape Reconstruction
  41. TASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation
  42. Towards Practical Human Motion Prediction with LiDAR Point Clouds
  43. UC-NERF: Neural Radiance Field for Under-Calibrated Multi-View Cameras in Autonomous Driving
  44. WildRefer: 3D Object Localization in Large-Scale Dynamic Scenes with Multi-modal Visual Data and Natural Language
  45. Wonder3D: Single Image to 3D Using Cross-Domain Diffusion