PPaperPicks

Ziyong Feng

18 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. UniME-V2: MLLM-as-a-Judge for Universal Multimodal Embedding Learning
  2. ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMs
  3. Breaking the Modality Barrier: Universal Embedding Learning with Multimodal LLMs
  4. CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination
  5. Decoupled Global-Local Alignment for Improving Compositional Understanding
  6. Dual-Level Open-Vocabulary 3D Scene Representation for Instance-Aware Robot Navigation
  7. Gradient-Attention Guided Dual-Masking Synergetic Framework for Robust Text-based Person Retrieval
  8. HUST: High-Fidelity Unbiased Skin Tone Estimation via Texture Quantization
  9. MotionStreamer: Streaming Motion Generation via Diffusion-Based Autoregressive Model in Causal Latent Space
  10. ORID: Organ-Regional Information Driven Framework for Radiology Report Generation
  11. RealSyn: An Effective and Scalable Multimodal Interleaved Document Transformation Paradigm
  12. Region-based Cluster Discrimination for Visual Representation Learning
  13. The Solution to the WWW25 Text-based Person Anomaly Search Challenge
  14. UniVerse: Unleashing the Scene Prior of Video Diffusion Models for Robust Radiance Field Reconstruction
  15. UniViT: Unifying Image and Video Understanding in One Vision Encoder
  16. IDAdapter: Learning Mixed Features for Tuning-Free Personalization of Text-to-Image Models
  17. Multi-label Cluster Discrimination for Visual Representation Learning
  18. RWKV-CLIP: A Robust Vision-Language Representation Learner