PPaperPicks

Shifeng Zhang

17 papers at tracked venues · 16 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation
  2. FUDOKI: Discrete Flow-based Unified Understanding and Generation via Kinetic-Optimal Velocities
  3. Generative Map Priors for Collaborative BEV Semantic Segmentation
  4. Learning Shape-Independent Transformation via Spherical Representations for Category-Level Object Pose Estimation
  5. LiT: Delving into a Simple Linear Diffusion Transformer for Image Generation
  6. Pamba: Enhancing Global Interaction in Point Clouds via State Space Model
  7. Point Cluster: A Compact Message Unit for Communication-Efficient Collaborative Perception
  8. Rethinking Correspondence-based Category-Level Object Pose Estimation
  9. Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
  10. Structure-Aware Correspondence Learning for Relative Pose Estimation
  11. Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis
  12. TurboVSR: Fantastic Video Upscalers and Where to Find Them
  13. VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection
  14. Accelerating Diffusion Sampling with Optimized Time Steps
  15. Aggregation and Purification: Dual Enhancement Network for Point Cloud Few-shot Segmentation
  16. Generating compositional scenes via Text-to-image RGBA Instance Generation
  17. MULAN: A Multi Layer Annotated Dataset for Controllable Text-to-Image Generation