PPaperPicks

Jing Zhang

Australian National University, Research School of Engineering, Canberra, Australia

18 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Learning Spatial Decay for Vision Transformers
  2. SteerMusic: Enhanced Musical Consistency for Zero-shot Text-Guided and Personalized Music Editing
  3. Unlocking Vision-Language Models for Video Anomaly Detection via Fine-Grained Prompting
  4. Black Sheep in the Herd: Playing with Spuriously Correlated Attributes for Vision-Language Recognition
  5. Brain-Inspired Spiking Neural Networks for Energy-Efficient Object Detection
  6. Identifying and Mitigating Position Bias of Multi-image Vision-Language Models
  7. Multi-axis Prompt and Multi-dimension Fusion Network for All-in-one Weather-degraded Image Restoration
  8. Patch-level Sounding Object Tracking for Audio-Visual Question Answering
  9. Probability Density Geodesics in Image Diffusion Latent Space
  10. Adversarial Purification with the Manifold Hypothesis
  11. ArGue: Attribute-Guided Prompt Tuning for Vision-Language Models
  12. DreamSteerer: Enhancing Source Image Conditioned Editability using Personalized Diffusion Models
  13. HybridVC: Efficient Voice Style Conversion with Text and Audio Prompts
  14. IMPUS: Image Morphing with Perceptually-Uniform Sampling Using Diffusion Models
  15. LaViP: Language-Grounded Visual Prompting
    AAAI 2024 ·
    Nilakshan Kunananthaseelan
  16. Latent Optimal Paths by Gumbel Propagation for Variational Bayesian Dynamic Programming
  17. Latent-based Diffusion Model for Long-tailed Recognition
  18. TAVGBench: Benchmarking Text to Audible-Video Generation