PPaperPicks

Shiming Xiang

16 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Beyond Counting: Evaluating Abstract and Emotional Reasoning in Vision-Language Models
  2. LookFlow: Training-Free and Efficient High-Resolution Image Synthesis via Dynamic Lookahead Guidance Flow
  3. WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering
  4. Diffusion Model as a Noise-Aware Latent Reward Model for Step-Level Preference Optimization
  5. EvoVLMA: Evolutionary Vision-Language Model Adaptation
  6. Faster and Better LLMs via Latency-Aware Test-Time Scaling
  7. Knowledge-based Visual Question Answer with Multimodal Processing, Retrieval and Filtering
  8. Re-ranking Reasoning Context with Tree Search Makes Large Vision-Language Models Stronger
  9. UNIP: Rethinking Pre-trained Attention Patterns for Infrared Semantic Segmentation
  10. AddressCLIP: Empowering Vision-Language Models for City-Wide Image Address Localization
  11. An Efficient Graph Autoencoder with Lightweight Desmoothing Decoder and Long-Range Modeling
  12. Cooperation Does Matter: Exploring Multi-Order Bilateral Relations for Audio-Visual Segmentation
  13. Defying Imbalanced Forgetting in Class Incremental Learning
  14. Dual Critic Reinforcement Learning under Partial Observability
  15. Enhancing Visual Continual Learning with Language-Guided Supervision
  16. Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning