PPaperPicks

Shengfeng He

42 papers at tracked venues · 36 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Cross-modal Proxy Evolving for OOD Detection with Vision-Language Models
  2. VideoSketcher: A Training-Free Approach for Coherent Video Sketch Transfer
  3. Action Dubber: Timing Audible Actions via Inflectional Flow
  4. Adversarial Attacks on Event-Based Pedestrian Detectors: A Physical Approach
  5. Art4Math: Handwritten Mathematical Expression Recognition via Multimodal Sketch Grounding
  6. Connecting Giants: Synergistic Knowledge Transfer of Large Multimodal Models for Few-Shot Learning
  7. Cross-Subject Mind Decoding from Inaccurate Representations
  8. DiffusionMat: Alpha Matting as Deterministic Sequential Refinement Learning
  9. Dr. Tongue: Sign-Oriented Multi-label Detection for Remote Tongue Diagnosis
  10. Instance-Level Video Depth in Groups Beyond Occlusions
  11. Instruct2See: Learning to Remove Any Obstructions Across Distributions
  12. Jury-and-Judge Chain-of-Thought for Uncovering Toxic Data in 3D Visual Grounding
  13. Keep the Balance: A Parameter-Efficient Symmetrical Framework for RGB+X Semantic Segmentation
  14. Knowledge Bridger: Towards Training-Free Missing Modality Completion
  15. Language-Driven 3D Human Pose Estimation in Multi-Person Scenarios: A New Dataset and Approach
  16. MODfinity: Unsupervised Domain Adaptation with Multimodal Information Flow Intertwining
  17. Neptune-X: Active X-to-Maritime Generation for Universal Maritime Object Detection
  18. NexusGS: Sparse View Synthesis with Epipolar Depth Priors in 3D Gaussian Splatting
  19. Occlusion-Insensitive Talking Head Video Generation via Facelet Compensation
  20. OmniVTON: Training-Free Universal Virtual Try-On
  21. PersonaMagic: Stage-Regulated High-Fidelity Face Customization with Tandem Equilibrium
  22. RecDreamer: Consistent Text-to-3D Generation via Uniform Score Distillation
  23. Registration is a Powerful Rotation-Invariance Learner for 3D Anomaly Detection
  24. Safe-Sora: Safe Text-to-Video Generation via Graphical Watermarking
  25. Seeing 3D Through 2D Lenses: 3D Few-Shot Class-Incremental Learning via Cross-Modal Geometric Rectification
  26. Stable Score Distillation
  27. StableGuard: Towards Unified Copyright Protection and Tamper Localization in Latent Diffusion Models
  28. Stroke2Sketch: Harnessing Stroke Attributes for Training-Free Sketch Generation
  29. ViewSRD: 3D Visual Grounding Via Structured Multi-View Decomposition
  30. Beat-It: Beat-Synchronized Multi-condition 3D Dance Generation
  31. Beyond Textual Constraints: Learning Novel Diffusion Conditions with Fewer Examples
  32. D3still: Decoupled Differential Distillation for Asymmetric Image Retrieval
  33. Delving into Multimodal Prompting for Fine-Grained Visual Classification
  34. DenseTrack: Drone-Based Crowd Tracking via Density-Aware Motion-Appearance Synergy
  35. Drag Your Noise: Interactive Point-based Editing via Diffusion Semantic Propagation
  36. Learning with Unreliability: Fast Few-Shot Voxel Radiance Fields with Relative Geometric Consistency
  37. OneRestore: A Universal Restoration Framework for Composite Degradation
  38. Portrait Shadow Removal via Self-Exemplar Illumination Equalization
  39. RePOSE: 3D Human Pose Estimation via Spatio-Temporal Depth Relational Consistency
  40. Rethinking Multi-View Representation Learning via Distilled Disentangling
  41. VrdONE: One-stage Video Visual Relation Detection
  42. Zero-Shot Object Counting with Good Exemplars