PPaperPicks

Qingming Huang

University of Chinese Academy of Sciences, School of Computer Science and Technology, Beijing, China

61 papers at tracked venues · 58 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. DMGINE: Day-Memory Guided Nighttime Image Enhancement for Dynamic Traffic Scenes
  2. HiGFA: Hierarchical Guidance for Fine-grained Data Augmentation with Diffusion Models
  3. Quantifying the Potential to Escape Filter Bubbles: A Behavior-Aware Measure via Contrastive Simulation
  4. The Devil is in the Distributions: Explicit Modeling of Scene Content is Key in Zero-Shot Video Captioning
  5. TuckA: Hierarchical Compact Tensor Experts for Efficient Fine-Tuning
  6. A Unified Framework for Stealthy Adversarial Generation via Latent Optimization and Transferability Enhancement
  7. ABKD: Pursuing a Proper Allocation of the Probability Mass in Knowledge Distillation via α-β-Divergence
  8. Bidirectional Logits Tree: Pursuing Granularity Reconcilement in Fine-Grained Classification
  9. Cannot See the Forest for the Trees: Invoking Heuristics and Biases to Elicit Irrational Choices of LLMs
  10. Change Entity-guided Heterogeneous Representation Disentangling for Change Captioning
  11. Diffusion-based Adversarial Purification from the Perspective of the Frequency Domain
  12. Dis²Booth: Learning Image Distribution with Disentangled Features for Text-to-Image Diffusion Models
  13. Divide and Conquer: Heterogeneous Noise Integration for Diffusion-based Adversarial Purification
  14. EmoDubber: Towards High Quality and Emotion Controllable Movie Dubbing
  15. Enhancing Pre-trained Representation Classifiability can Boost its Interpretability
  16. Exploring Structural Degradation in Dense Representations for Self-supervised Learning
  17. FlowDubber: Movie Dubbing with LLM-based Semantic-aware Learning and Flow Matching based Voice Enhancing
  18. Focal-SAM: Focal Sharpness-Aware Minimization for Long-Tailed Classification
  19. Generalizing Single-Frame Supervision to Event-Level Understanding for Video Anomaly Detection
  20. Hybrid Generative Fusion for Efficient and Privacy-Preserving Face Recognition Dataset Generation
  21. Image-to-video Adaptation with Outlier Modeling and Robust Self-learning
  22. LightFair: Towards an Efficient Alternative for Fair T2I Diffusion via Debiasing Pre-trained Text Encoders
  23. MGVC: MLLM-Guided Video Captioning for the IntentVC Challenge
  24. MixBridge: Heterogeneous Image-to-Image Backdoor Attack through Mixture of Schrödinger Bridges
  25. One Image is Worth a Thousand Words: A Usability Preservable Text-Image Collaborative Erasing Framework
  26. OpenworldAUC: Towards Unified Evaluation and Optimization for Open-world Prompt Tuning
  27. Query-centric Audio-Visual Cognition Network for Moment Retrieval, Segmentation and Step-Captioning
  28. Relieving the Over-Aggregating Effect in Graph Transformers
  29. SDVPT: Semantic-Driven Visual Prompt Tuning for Open-world Object Counting
  30. SSE-SAM: Balancing Head and Tail Classes Gradually Through Stage-Wise SAM
  31. SVDLoRA: Data-Driven Low-Rank Adaptation via Spectral Decomposition
  32. SafeCFG: Controlling Harmful Features with Dynamic Safe Guidance for Safe Generation
  33. Separation of Powers: On Segregating Knowledge from Observation in LLM-enabled Knowledge-based Visual Question Answering
  34. VL-SAE: Interpreting and Enhancing Vision-Language Alignment with a Unified Concept Set
  35. Video Language Model Pretraining with Spatio-temporal Masking
  36. When the Future Becomes the Past: Taming Temporal Correspondence for Self-supervised Video Representation Learning
  37. ADA-GAD: Anomaly-Denoised Autoencoders for Graph Anomaly Detection
  38. AUCSeg: AUC-oriented Pixel-level Long-tail Semantic Segmentation
  39. Bias-Conflict Sample Synthesis and Adversarial Removal Debias Strategy for Temporal Sentence Grounding in Video
  40. Context-aware Difference Distilling for Multi-change Captioning
  41. Data-free Neural Representation Compression with Riemannian Neural Dynamics
  42. Distractors-Immune Representation Learning with Cross-Modal Contrastive Regularization for Change Captioning
  43. ESNet: Evolution and Succession Network for High-Resolution Salient Object Detection
  44. Expanding Sparse Tuning for Low Memory Usage
  45. HGOE: Hybrid External and Internal Graph Outlier Exposure for Graph Out-of-Distribution Detection
  46. Harnessing Hierarchical Label Distribution Variations in Test Agnostic Long-tail Recognition
  47. Leveraging Catastrophic Forgetting to Develop Safe Diffusion Models against Malicious Finetuning
  48. Modeling Language Tokens as Functionals of Semantic Fields
  49. MovingColor: Seamless Fusion of Fine-grained Video Color Enhancement
  50. Not All Diffusion Model Activations Have Been Evaluated as Discriminative Features
  51. Not All Pairs are Equal: Hierarchical Learning for Average-Precision-Oriented Video Retrieval
  52. Prompt-Enhanced Multiple Instance Learning for Weakly Supervised Video Anomaly Detection
  53. R&B: Region and Boundary Aware Zero-shot Grounded Text-to-image Generation
  54. ReconBoost: Boosting Can Achieve Modality Reconcilement
  55. Regularized Contrastive Partial Multi-view Outlier Detection
  56. Size-invariance Matters: Rethinking Metrics and Losses for Imbalanced Multi-object Salient Object Detection
  57. StyleDubber: Towards Multi-Scale Style Learning for Movie Dubbing
  58. Suppress Content Shift: Better Diffusion Features via Off-the-Shelf Generation Techniques
  59. Towards Dynamic Message Passing on Graphs
  60. Unsupervised Image-to-Video Adaptation via Category-aware Flow Memory Bank and Realistic Video Generation
  61. Weakly Supervised Video Individual Counting