PPaperPicks

Tao Mei

JD AI Research, Beijing, China

26 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting
  2. Aligning Global Semantics and Local Textures in Generative Video Enhancement
  3. Denoising Token Prediction in Masked Autoregressive Models
  4. Edit-by-Example: Adaptive Exemplar-Based Image Editing
  5. HiDream-I1: An Open-Source High-Efficient Image Generative Foundation Model
  6. Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
  7. Identity-Preserving Video Generation Challenge
  8. Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
  9. MotionPro: A Precise Motion Controller for Image-to-Video Generation
  10. Ouroboros-Diffusion: Exploring Consistent Content Generation in Tuning-free Long Video Diffusion
  11. Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
  12. Talk, Imagine, Evolve: A Unified Multimodal Agent for Seamless Visual Generation and Editing
  13. VTON-VLLM: Aligning Virtual Try-On Models with Human Preferences
  14. Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
  15. CLaM: An Open-Source Library for Performance Evaluation of Text-driven Human Motion Generation
  16. DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
  17. FreeEnhance: Tuning-Free Image Enhancement via Content-Consistent Noising-and-Denoising Process
  18. Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
  19. Improving Text-Guided Object Inpainting with Semantic Pre-inpainting
  20. Improving Virtual Try-On with Garment-Focused Diffusion Models
  21. Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
  22. Prompt Refinement with Image Pivot for Text-to-Image Generation
  23. SD-DiT: Unleashing the Power of Self-Supervised Discrimination in Diffusion Transformer*
  24. TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
  25. VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
  26. VideoStudio: Generating Consistent-Content and Multi-scene Videos