PPaperPicks

Bing Li

Chinese Academy of Sciences, Institute of Automation, National Laboratory of Pattern Recognition, Beijing, China

23 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Exploiting Geometric Structures for Modeling Multi-Agent Behaviors: A New Thinking
  2. MMhops-R1: Multimodal Multi-hop Reasoning
  3. Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation
  4. DeepTAGE: Deep Temporal-Aligned Gradient Enhancement for Optimizing Spiking Neural Networks
  5. MI-TRQR: Mutual Information-Based Temporal Redundancy Quantification and Reduction for Energy-Efficient Spiking Neural Networks
  6. Mitigating Hallucinations in Large Vision-Language Models by Self-Injecting Hallucinations
  7. Multimodal Large Language Model-Guided ISP Hyperparameter Optimization with Dynamic Preference Learning
  8. Noise-Optimized Distribution Distillation for Dataset Condensation
  9. Reversing Flow for Image Restoration
  10. SynCL: A Synergistic Training Strategy with Instance-Aware Contrastive Learning for End-to-End Multi-Camera 3D Tracking
  11. Towards More Discriminative Feature Learning in SNNs with Temporal-Self-Erasing Supervision
  12. VisionMath: Vision-Form Mathematical Problem-Solving
  13. Visual-Instructed Degradation Diffusion for All-in-One Image Restoration
  14. AIM 2024 Challenge on UHD Blind Photo Quality Assessment
  15. EA-VTR: Event-Aware Video-Text Retrieval
  16. How to Make Cross Encoder a Good Teacher for Efficient Image-Text Retrieval?
  17. MIBench: Evaluating Multimodal Large Language Models over Multiple Images
  18. MobileIQA: Exploiting Mobile-Level Diverse Opinion Network For No-Reference Image Quality Assessment Using Knowledge Distillation
  19. NFT1000: A Cross-Modal Dataset For Non-Fungible Token Retrieval
  20. PromptIQA: Boosting the Performance and Generalization for No-Reference Image Quality Assessment via Prompts
  21. RL-SeqISP: Reinforcement Learning-Based Sequential Optimization for Image Signal Processing
  22. Set Prediction Guided by Semantic Concepts for Diverse Video Captioning
  23. VQ-Map: Bird's-Eye-View Map Layout Estimation in Tokenized Discrete Space via Vector Quantization