PPaperPicks

Errui Ding

24 papers at tracked venues · 19 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. AudCast: Audio-Driven Human Video Generation by Cascaded Diffusion Transformers
  2. Explanatory Instructions: Towards Unified Vision Tasks Understanding and Zero-shot Generalization
  3. Interpretable Face Anti-Spoofing: Enhancing Generalization with Multimodal Large Language Models
  4. MGMapNet: Multi-Granularity Representation Learning for End-to-End Vectorized HD Map Construction
  5. Re-HOLD: Video Hand Object Interaction Reenactment via adaptive Layout-instructed Diffusion Model
  6. Splatter-360: Generalizable 360 Gaussian Splatting for Wide-baseline Panoramic Images
  7. TexGarment: Consistent Garment UV Texture Generation via Efficient 3D Structure-Guided Diffusion Transformer
  8. TexGaussian: Generating High-quality PBR Material via Octree-based 3D Gaussian Splatting
  9. Uni2Det: Unified and Universal Framework for Prompt-Guided Multi-dataset 3D Detection
  10. Decoupled Pseudo-Labeling for Semi-Supervised Monocular 3D Object Detection
  11. GGRt: Towards Pose-Free Generalizable 3D Gaussian Splatting in Real-Time
  12. Interactive 3D Object Detection with Prompts
  13. KD-DETR: Knowledge Distillation for Detection Transformer with Consistent Distillation Points Sampling
  14. LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction
  15. MS-DETR: Efficient DETR Training with Mixed Supervision
  16. Multi-Domain Incremental Learning for Face Presentation Attack Detection
  17. OPEN: Object-Wise Position Embedding for Multi-view 3D Object Detection
  18. Octopus: A Multi-modal LLM with Parallel Recognition and Sequential Understanding
  19. OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding
  20. ReSyncer: Rewiring Style-Based Generator for Unified Audio-Visually Synced Facial Performer
  21. ShowMaker: Creating High-Fidelity 2D Human Video via Fine-Grained Diffusion Modeling
  22. TexOct: Generating Textures of 3D Models with Octree-based Diffusion
  23. Towards Unified Multi-granularity Text Detection with Interactive Attention
  24. VRP-SAM: SAM with Visual Reference Prompt