PPaperPicks

Yong Luo

Wuhan University, School of Computer Science, Hubei Key Laboratory of Multimedia and Network Communication Engineering, China

34 papers at tracked venues · 28 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Physics-Informed Multi-Task Learning for Battery State of Health Prediction with Uncertainty Quantification
  2. Rethinking Visual Token Reduction in LVLMs Under Cross-Modal Misalignment
  3. SRD: Reinforcement-Learned Semantic Perturbation for Backdoor Defense in VLMs
  4. A Dual Stream Visual Tokenizer for LLM Image Generation
  5. AiDE-Q: Synthetic Labeled Datasets Can Enhance Learning Models for Quantum Property Estimation
  6. Anatomy-Conserving Unpaired CBCT-to-CT Translation via Schrödinger Bridge
  7. Decision Mixer: Integrating Long-term and Local Dependencies via Dynamic Token Selection for Decision-Making
  8. Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models
  9. ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
  10. FIRING-Net: A filtered feature recycling network for speech enhancement
  11. MTGA: Multi-View Temporal Granularity Aligned Aggregation for Event-Based Lip-Reading
  12. Merging on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
  13. MixPrompt: Efficient Mixed Prompting for Multimodal Semantic Segmentation
  14. Open-Vocabulary Fine-Grained Hand Action Detection
  15. Retrieval-Augmented Perception: High-resolution Image Perception Meets Visual RAG
  16. Self-Evolving Pseudo-Rehearsal for Catastrophic Forgetting with Task Similarity in LLMs
  17. Targeted Low-rank Refinement: Enhancing Sparse Language Models with Precision
  18. Value-Guided Decision Transformer: A Unified Reinforcement Learning Framework for Online and Offline Settings
  19. Confronting Reward Overoptimization for Diffusion Models: A Perspective of Inductive and Primacy Biases
  20. Cycle Self-Refinement for Multi-Source Domain Adaptation
  21. Decomposed Prompt Decision Transformer for Efficient Unseen Task Generalization
  22. Decomposing Semantic Shifts for Composed Image Retrieval
  23. Eliminating the Cross-Domain Misalignment in Text-guided Image Inpainting
  24. Improving Generalized Zero-Shot Learning by Exploring the Diverse Semantics from External Class Names
  25. Joint Input and Output Coordination for Class-Incremental Learning
  26. MG-Net: Learn to Customize QAOA with Circuit Depth Awareness
  27. MMSite: A Multi-modal Framework for the Identification of Active Sites in Proteins
  28. Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
  29. Multi-Granularity Hand Action Detection
  30. OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
  31. Parameter-Efficient Multi-Task Model Fusion with Partial Linearization
  32. PrimKD: Primary Modality Guided Multimodal Fusion for RGB-D Semantic Segmentation
  33. WisdoM: Improving Multimodal Sentiment Analysis by Fusing Contextual World Knowledge
  34. Zero-shot Learning for Preclinical Drug Screening