PPaperPicks

Jian Zhang

Peking University Shenzhen Graduate School, School of Electronic and Computer Engineering, Shenzhen, China

24 papers at tracked venues · 23 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning
  2. Adversarial Diffusion Compression for Real-World Image Super-Resolution
  3. FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models
  4. OSMamba: Omnidirectional Spectral Mamba with Dual-Domain Prior Generator for Exposure Correction
  5. OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking
  6. SecureGS: Boosting the Security and Fidelity of 3D Gaussian Splatting Steganography
  7. SkillMimic: Learning Basketball Interaction Skills from Demonstrations
  8. Spk2SRImgNet: Super-Resolve Dynamic Scene from Spike Stream via Motion Aligned Collaborative Filtering
  9. 360DVD: Controllable Panorama Video Generation with 360-Degree Video Diffusion Model
  10. Boosting Spike Camera Image Reconstruction from a Perspective of Dealing with Spike Fluctuations
  11. DiffEditor: Boosting Accuracy and Flexibility on Diffusion-Based Image Editing
  12. DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
  13. EditGuard: Versatile Image Watermarking for Tamper Localization and Copyright Protection
  14. GS-Hider: Hiding Messages into 3D Gaussian Splatting
  15. Joint Demosaicing and Denoising for Spike Camera
  16. OmniSSR: Zero-Shot Omnidirectional Image Super-Resolution Using Stable Diffusion Model
  17. OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding
  18. Optical Flow for Spike Camera with Hierarchical Spatial-Temporal Spike Fusion
  19. Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts
  20. ReVideo: Remake a Video with Motion and Content Control
  21. ResVR: Joint Rescaling and Viewport Rendering of Omnidirectional Images
  22. Super-Resolution Reconstruction from Bayer-Pattern Spike Streams
  23. T2I-Adapter: Learning Adapters to Dig Out More Controllable Ability for Text-to-Image Diffusion Models
  24. V2A-Mark: Versatile Deep Visual-Audio Watermarking for Manipulation Localization and Copyright Protection