PPaperPicks

Nicu Sebe

University of Trento, Italy

57 papers at tracked venues · 44 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ATM: Enhanced Alignment for Text-to-Motion Generation
  2. Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
  3. Open-World Deepfake Attribution via Confidence-Aware Asymmetric Learning
  4. Reverse Personalization
  5. Safe Vision-Language Models via Unsafe Weights Manipulation
  6. Wasserstein-Aligned Hyperbolic Multi-View Clustering
  7. 3D Part Segmentation via Geometric Aggregation of 2D Visual Features
  8. A Correlation Manifold Self-Attention Network for EEG Decoding
  9. ADAPTOR: Adaptive Token Reduction for Video Diffusion Transformers
  10. AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
  11. CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
  12. Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
  13. Curriculum Direct Preference Optimization for Diffusion and Consistency Models
  14. Face Anonymization Made Simple
  15. FisherTune: Fisher-Guided Robust Tuning of Vision Foundation Models for Domain Generalized Segmentation
  16. FreeInsert: Disentangled Text-Guided Object Insertion in 3D Gaussian Scene without Spatial Priors
  17. Generate, Refine, and Encode: Leveraging Synthesized Novel Samples for On-the-Fly Fine-Grained Category Discovery
  18. Gyrogroup Batch Normalization
  19. Hierarchical Visual Prompt Learning for Continual Video Instance Segmentation
  20. In-Context Meta LoRA Generation
  21. Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
  22. NTIRE 2025 Challenge on Cross-Domain Few-Shot Object Detection: Methods and Results
  23. Pseudo-SD: Pseudo Controlled Stable Diffusion for Semi-Supervised and Cross-Domain Semantic Segmentation
  24. Robust Consensus Anchor Learning for Efficient Multi-view Subspace Clustering
  25. SceneSplat++: A Large Dataset and Comprehensive Benchmark for Language Gaussian Splatting
  26. SceneSplat: Gaussian Splatting-Based Scene Understanding with Vision-Language Pretraining
  27. Superpowering Open-Vocabulary Object Detectors for X-ray Vision
  28. Towards a General Attention Framework on Gyrovector Spaces for Matrix Manifolds
  29. Transferable-Guided Attention Is All You Need for Video Domain Adaptation
  30. Understanding Matrix Function Normalizations in Covariance Pooling through the Lens of Riemannian Geometry
  31. Unveiling Open-set Noise: Theoretical Insights into Label Noise
  32. What Changed? Detecting and Evaluating Instruction-Guided Image Edits with Multimodal Large Language Models
  33. When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding
  34. 3D Weakly Supervised Semantic Segmentation with 2D Vision-Language Guidance
  35. A Lie Group Approach to Riemannian Batch Normalization
  36. Connectivity-Driven Pseudo-Labeling Makes Stronger Cross-Domain Segmenters
  37. Cross-Class Domain Adaptive Semantic Segmentation with Visual Language Models
  38. Democratizing Fine-grained Visual Recognition with Large Language Models
  39. Diversity-Authenticity Co-constrained Stylization for Federated Domain Generalization in Person Re-identification
  40. Federated Generalized Category Discovery
  41. Generalized Source-Free Domain-adaptive Segmentation via Reliable Knowledge Propagation
  42. Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation
  43. LESS: Label-Efficient and Single-Stage Referring 3D Segmentation
  44. Learning to Distinguish Samples for Generalized Category Discovery
  45. Mitigating robust overfitting via self-residual-calibration regularization (Abstract Reprint)
  46. OpenBias: Open-Set Bias Detection in Text-to-Image Generative Models
  47. Optimizing Resource Consumption in Diffusion Models Through Hallucination Early Detection
  48. PAIR Diffusion: A Comprehensive Multimodal Object-Level Image Editor
  49. Prototypical Hash Encoding for On-the-Fly Fine-Grained Category Discovery
  50. RMLR: Extending Multinomial Logistic Regression into General Geometries
  51. Riemannian Multinomial Logistics Regression for SPD Neural Networks
  52. SM4Depth: Seamless Monocular Metric Depth Estimation across Multiple Cameras and Scenes by One Model
  53. Sharing Key Semantics in Transformer Makes Efficient Image Restoration
  54. Stable Neighbor Denoising for Source-free Domain Adaptive Segmentation
  55. Textual Knowledge Matters: Cross-Modality Co-teaching for Generalized Visual Class Discovery
  56. Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning
  57. UVMap-ID: A Controllable and Personalized UV Map Generative Model