PPaperPicks

Zhengkai Jiang

Tencent, Youtu Lab, Shanghai, China

16 papers at tracked venues · 10 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. EnerVerse: Envisioning Embodied Future Space for Robotics Manipulation
  2. Foundation Cures Personalization: Improving Personalized Models' Prompt Consistency via Hidden Foundation Knowledge
  3. Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation
  4. OSV: One Step is Enough for High-Quality Image to Video Generation
  5. PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
  6. SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation
  7. UniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models
  8. Density Matters: Improved Core-Set for Active Domain Adaptive Segmentation
  9. DiffuMatting: Synthesizing Arbitrary Objects with Matting-Level Annotation
  10. Learning Unified Reference Representation for Unsupervised Multi-class Anomaly Detection
  11. MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
  12. MambaGesture: Enhancing Co-Speech Gesture Generation with Mamba and Disentangled Multi-Modality Fusion
  13. ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models
  14. Personalize Segment Anything Model with One Shot
  15. SDSTrack: Self-Distillation Symmetric Adapter Learning for Multi-Modal Visual Object Tracking
  16. UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation