PPaperPicks

Sanping Zhou

28 papers at tracked venues · 23 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. TSPO: Temporal Sampling Policy Optimization for Long-form Video Language Understanding
  2. Boosting Point-Supervised Temporal Action Localization through Integrating Query Reformation and Optimal Transport
  3. DAMap: Distance-Aware MapNet for High Quality HD Map Construction
  4. Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
  5. DynaRend: Learning 3D Dynamics via Masked Future Rendering for Robotic Manipulation
  6. Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction
  7. Event-Equalized Dense Video Captioning
  8. FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation
  9. FreqPDE: Rethinking Positional Depth Embedding for Multi-View 3D Object Detection Transformers
  10. Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
  11. Moment Quantization for Video Temporal Grounding
  12. PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic Manipulation
  13. REGNav: Room Expert Guided Image-Goal Navigation
  14. RefDetector: A Simple Yet Effective Matching-based Method for Referring Expression Comprehension
  15. SAMPO: Scale-wise Autoregression with Motion Prompt for Generative World Models
  16. Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion
  17. Versatile Multimodal Controls for Expressive Talking Human Animation
  18. AugDETR: Improving Multi-scale Learning for Detection Transformer
  19. Learning Anomalies with Normality Prior for Unsupervised Video Anomaly Detection
  20. Molecule Design by Latent Prompt Transformer
  21. PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image Segmentation
  22. Referencing Where to Focus: Improving Visual Grounding with Referential Query
  23. Semantic-aware Representation Learning for Homography Estimation
  24. Stepwise Multi-grained Boundary Detector for Point-Supervised Temporal Action Localization
  25. Temporal Correlation Vision Transformer for Video Person Re-Identification
  26. Towards Generalizable Multi-Object Tracking
  27. Vehicle Trajectory Prediction with Soft Behavior Constraints
  28. Voxel or Pillar: Exploring Efficient Point Cloud Representation for 3D Object Detection