PPaperPicks

Wei Shen

Shanghai Jiao Tong University, Artificial Intelligence Institute, China

29 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CP-CLIP: Customized Parameter Generation for Open-vocabulary Semantic Segmentation
  2. Dereflection Any Image with Diffusion Priors and Diversified Data
  3. Efficient Segmentation with Multimodal Large Language Model via Token Routing
  4. Few-step Flow for 3D Generation via Marginal-Data Transport Distillation
  5. WorldGrow: Generating Infinite 3D World
  6. A Token-Level Text Image Foundation Model for Document Understanding
  7. Domain Generalization in CLIP via Learning with Diverse Text Prompts
  8. EndoDAV: Depth Any Video in Endoscopy with Spatiotemporal Accuracy
  9. FATE: Feature-Adapted Parameter Tuning for Vision-Language Models
  10. Generalized Tensor-Based Parameter-Efficient Fine-Tuning via Lie Group Transformations
  11. HyperET: Efficient Training in Hyperbolic Space for Multi-modal Large Language Models
  12. Maintaining Structural Integrity in Parameter Spaces for Parameter Efficient Fine-tuning
  13. Marten: Visual Question Answering with Mask Generation for Multi-modal Document Understanding
  14. OPMapper: Enhancing Open-Vocabulary Semantic Segmentation with Multi-Guidance Information
  15. Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation
  16. Segment Any 3D Gaussians
  17. Star with Bilinear Mapping
  18. Tackling View-Dependent Semantics in 3D Language Gaussian Splatting
  19. Understanding Fine-tuning CLIP for Open-vocabulary Semantic Segmentation in Hyperbolic Space
  20. Unleashing the Power of Task-Specific Directions in Parameter Efficient Fine-tuning
  21. Bridging Synthetic and Real Worlds for Pre-Training Scene Text Detectors
  22. EndoGSLAM: Real-Time Dense Reconstruction and Tracking in Endoscopic Surgeries Using Gaussian Splatting
  23. Missing as Masking: Arbitrary Cross-Modal Feature Reconstruction for Incomplete Multimodal Brain Tumor Segmentation
  24. Parameter Efficient Fine-Tuning via Cross Block Orchestration for Segment Anything Model
  25. Partial Label Learning with a Partner
  26. PosFormer: Recognizing Complex Handwritten Mathematical Expression with Position Forest Transformer
  27. SAM-PARSER: Fine-Tuning SAM Efficiently by Parameter Space Reconstruction
  28. Tendency-Driven Mutual Exclusivity for Weakly Supervised Incremental Semantic Segmentation
  29. UniProcessor: A Text-Induced Unified Low-Level Image Processor