PPaperPicks

Jun Liu

Lancaster University, UK

49 papers at tracked venues · 38 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG
  2. An Image-like Diffusion Method for Human-Object Interaction Detection
  3. Boosting Skeleton-based Zero-Shot Action Recognition with Training-Free Test-Time Adaptation
  4. Boundary Probing for Input Privacy Protection when Using LMM Services
  5. CMMLoc: Advancing Text-to-PointCloud Localization with Cauchy-Mixture-Model Based Framework
  6. CPCF: A Cross-Prompt Contrastive Framework for Referring Multimodal Large Language Models
  7. CoFFT: Chain of Foresight-Focus Thought for Visual Language Models
  8. Cross-modal Collaborative Representation Learning for Text-to-Image Person Retrieval
  9. Deconfound Semantic Shift and Incompleteness in Incremental Few-shot Semantic Segmentation
  10. DiffIP: Representation Fingerprints for Robust IP Protection of Diffusion Models
  11. Diffuse&Refine: Intrinsic Knowledge Generation and Aggregation for Incremental Object Detection
  12. Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
  13. GaussianBlock: Building Part-Aware Compositional and Editable 3D Scene by Primitives and Gaussians
  14. Global-Semantic Alignment Distillation for Partial Multi-view Classification
  15. Hierarchical Optimization via LLM-Guided Objective Evolution for Mobility-on-Demand Systems
  16. IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
  17. LongDiff: Training-Free Long Video Generation in One Go
  18. Making Every Step Effective: Jailbreaking Large Vision-Language Models Through Hierarchical KV Equalization
  19. POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation
  20. Performing Defocus Deblurring by Modeling its Formation Process
  21. PhysReason: A Comprehensive Benchmark towards Physics-Based Reasoning
  22. Recognizing Actions From Robotic View for Natural Human-Robot Interaction
  23. Stray Intrusive Outliers-Based Feature Selection on Intra-Class Asymmetric Instance Distribution or Multiple High-Density Clusters
  24. Throwing Planning Diffusion: A Solution to Learning and Planning of Robotic Throwing
  25. Towards Explicit Geometry-Reflectance Collaboration for Generalized LiDAR Segmentation in Adverse Weather
  26. 6D-Diff: A Keypoint Diffusion Framework for 6D Object Pose Estimation
  27. Action Detection via an Image Diffusion Process
  28. Addressing Background Context Bias in Few-Shot Segmentation Through Iterative Modulation
  29. Class-Agnostic Object Counting with Text-to-Image Diffusion Model
  30. Correlation Matching Transformation Transformers for UHD Image Restoration
  31. Diff-Tracker: Text-to-Image Diffusion Models are Unsupervised Trackers
  32. DisC-GS: Discontinuity-aware Gaussian Splatting
  33. GDR-GMA: Machine Unlearning via Direction-Rectified and Magnitude-Adjusted Gradients
  34. Generated and Pseudo Content guided Prototype Refinement for Few-shot Point Cloud Segmentation
  35. Harnessing Text-to-Image Diffusion Models for Category-Agnostic Pose Estimation
  36. Informative Point cloud Dataset Extraction for Classification via Gradient-based Points Moving
  37. LEAD: Exploring Logit Space Evolution for Model Selection
  38. LLMs are Good Action Recognizers
  39. LLMs are Good Sign Language Translators
  40. LLaFS: When Large Language Models Meet Few-Shot Segmentation
  41. LTGC: Long-Tail Recognition via Leveraging LLMs-Driven Generated Content
  42. LTRL: Boosting Long-Tail Recognition via Reflective Learning
  43. Learning to Unlearn for Robust Machine Unlearning
  44. Prototypical Prompting for Text-to-image Person Re-identification
  45. Referring Expression Counting
  46. Reverse2Complete: Unpaired Multimodal Point Cloud Completion via Guided Diffusion
  47. SemTrack: A Large-Scale Dataset for Semantic Tracking in the Wild
  48. Towards Physical World Backdoor Attacks Against Skeleton Action Recognition
  49. UPAM: Unified Prompt Attack in Text-to-Image Generation Models Against Both Textual Filters and Visual Checkers