PPaperPicks

Lefei Zhang

41 papers at tracked venues · 31 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Anchor-Guided Discriminative Subspace Alignment and Clustering for Cross-Scene Hyperspectral Imagery
  2. Any2RSI: Controllable Remote Sensing Text-to-Image Generation via Any Control and Enriched Description
  3. ClearAIR: A Human-Visual-Perception-Inspired All-in-One Image Restoration
  4. From AR to Diffusion: Efficiently Adapting Large Language Models with Strictly Causal and Elastic Horizons
  5. GoT-R1: Internalizing Graph-of-Thought via Structural Reinforcement for High-Density Reasoning
  6. OFL-SAM2: Prompt SAM2 with Online Few-shot Learner for Efficient Medical Image Segmentation
  7. RACER: Retrieval-Augmented Contextual Rapid Speculative Decoding
  8. RS2-SAM2: Customized SAM2 for Referring Remote Sensing Image Segmentation
  9. S5: Scalable Semi-Supervised Semantic Segmentation in Remote Sensing
  10. Scaling LLM Speculative Decoding: Non-Autoregressive Forecasting in Large-Batch Scenarios
  11. Vista-LLM: Decoupled Query-Guided Visual Token Pruning for Efficient Long-Video Large Language Models
  12. CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
  13. Deep Multi-Level Contrastive Clustering for Multi-Modal Remote Sensing Images
  14. HSRMamba: Contextual Spatial-Spectral State Space Model for Single Hyperspectral Image Super-Resolution
  15. Imitate Before Detect: Aligning Machine Stylistic Preference for Machine-Revised Text Detection
  16. KV-Latent: Dimensional-level KV Cache Reduction with Frequency-aware Rotary Positional Embedding
  17. Label Drop for Multi-Aspect Relation Modeling in Universal Information Extraction
  18. MPG-SAM 2: Adapting SAM 2 with Mask Priors and Global Context for Referring Video Object Segmentation
  19. Merging on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
  20. Multimodal Decomposed Distillation with Instance Alignment and Uncertainty Compensation for Thermal Object Detection
  21. NOTA: Multimodal Music Notation Understanding for Visual Large Language Model
  22. ScaleMatch: Multi-scale Consistency Enhancement for Semi-supervised Semantic Segmentation
  23. Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
  24. SongSong: A Time Phonograph for Chinese SongCi Music from Thousand of Years Away
  25. Spatial-Spectral Similarity-Guided Fusion Network for Pansharpening
  26. SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers
  27. The Energy Loss Phenomenon in RLHF: A New Perspective on Mitigating Reward Hacking
  28. ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models
  29. What Limits Bidirectional Model's Generative Capabilities? A Uni-Bi-Directional Mixture-of-Expert Method For Bidirectional Fine-tuning
  30. A Coin Has Two Sides: A Novel Detector-Corrector Framework for Chinese Spelling Correction
  31. A Novel Energy Based Model Mechanism for Multi-Modal Aspect-Based Sentiment Analysis
  32. Driving Scene Understanding with Traffic Scene-Assisted Topology Graph Transformer
  33. Eliminating the Cross-Domain Misalignment in Text-guided Image Inpainting
  34. InfoRM: Mitigating Reward Hacking in RLHF via Information-Theoretic Reward Modeling
  35. MAdapter: A Better Interaction Between Image and Language for Medical Image Segmentation
  36. MMSite: A Multi-modal Framework for the Identification of Active Sites in Proteins
  37. Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
  38. Multi-modal Auto-regressive Modeling via Visual Tokens
  39. Reference Trustable Decoding: A Training-Free Augmentation Paradigm for Large Language Models
  40. Sparse is Enough in Fine-tuning Pre-trained Large Language Models
  41. VHASR: A Multimodal Speech Recognition System With Vision Hotwords