PPaperPicks

Jinpeng Wang

Tsinghua Shenzhen, International Graduate School, Shenzhen, China

23 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. FEDIN: Frequency-Enhanced Deep Interest Network for Click-Through Rate Prediction
  2. From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
  3. HALoRA: Low-Rank Adaptation with Hierarchical Budget Allocation for Efficient Vision-Language Alignment
  4. Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
  5. Imagine with Layout and Sketch: Enhancing Vision-Language Retrieval with Dual-Stream Multi-Modal Query Refinement
  6. Suit the Remedy to the Retriever: Interpretable Query Optimization with Retriever Preference Alignment for Vision-Language Retrieval
  7. Towards Efficient Low-rate Image Compression with Frequency-aware Diffusion Prior Refinement
  8. AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
  9. Cassic: Towards Content-Adaptive State-Space Models for Learned Image Compression
  10. DiffPC: Diffusion-based High Perceptual Fidelity Image Compression with Semantic Refinement
  11. Efficient Self-Supervised Video Hashing with Selective State Spaces
    AAAI 2025 · Jinpeng Wang
  12. Embracing Collaboration Over Competition: Condensing Multiple Prompts for Visual In-Context Learning
    CVPR 2025 · Jinpeng Wang
  13. Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
  14. EvdCLIP: Improving Vision-Language Retrieval with Entity Visual Descriptions from Large Language Models
  15. MoSEs: Uncertainty-Aware AI-Generated Text Detection via Mixture of Stylistics Experts with Conditional Thresholds
  16. Modeling Uncertainty in Composed Image Retrieval via Probabilistic Embeddings
  17. PMA: Towards Parameter-Efficient Point Cloud Understanding via Point Mamba Adapter
  18. ROMA: Recommendation-Oriented Language Model Adaptation Using Multi-Modal Multi-Domain Item Sequences
  19. VLM as Policy: Common-Law Content Moderation Framework for Short Video Platform
  20. BoostAdapter: Improving Vision-Language Test-Time Adaptation via Regional Bootstrapping
  21. GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
  22. RAT: Retrieval-Augmented Transformer for Click-Through Rate Prediction
  23. ReFer: Retrieval-Enhanced Vertical Federated Recommendation for Full Set User Benefit