PPaperPicks

Ke Li

Tencent Youtu Lab, Shanghai, China

30 papers at tracked venues · 28 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Relaxing the Constraints: A Dual-Importance Projection Mechanism for Lifelong Model Editing
  2. Distilling Spatially-Heterogeneous Distortion Perception for Blind Image Quality Assessment
  3. Feature Denoising Diffusion Model for Blind Image Quality Assessment
  4. Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
  5. FlashSloth : Lightning Multimodal Large Language Models via Embedded Visual Compression
  6. Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM
  7. Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
  8. Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
  9. LTD-Bench: Evaluating Large Language Models by Letting Them Draw
  10. MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
  11. Probability-Density-aware Semi-supervised Learning
  12. Towards Universal Perception through Language-Guided Open-World Object Detection
  13. VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
  14. VITA-Audio: Fast Interleaved Audio-Text Token Generation for Efficient Large Speech-Language Model
  15. Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
  16. Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs
  17. A General and Efficient Training for Transformer via Token Expansion
  18. Adaptive Feature Selection for No-Reference Image Quality Assessment by Mitigating Semantic Noise Sensitivity
  19. Align Before Collaborate: Mitigating Feature Misalignment for Robust Multi-agent Perception
  20. Aligning and Prompting Everything All at Once for Universal Visual Perception
  21. Integrating Global Context Contrast and Local Sensitivity for Blind Image Quality Assessment
  22. Multimodal Inplace Prompt Tuning for Open-set Object Detection
  23. PediatricsGPT: Large Language Models as Chinese Medical Assistants for Pediatric Applications
  24. SPD-DDPM: Denoising Diffusion Probabilistic Models in the Symmetric Positive Definite Space
  25. Semi-Supervised Blind Image Quality Assessment through Knowledge Distillation and Incremental Learning
  26. SoftCLIP: Softer Cross-Modal Alignment Makes CLIP Stronger
  27. Solving the Catastrophic Forgetting Problem in Generalized Category Discovery
  28. Task-Adaptive Saliency Guidance for Exemplar-Free Class Incremental Learning
  29. Towards Multimodal Sentiment Analysis Debiasing via Bias Purification
  30. Weakly Supervised Open-Vocabulary Object Detection