PPaperPicks

Yan Yan

Illinois Institute of Technology, Department of Computer Science, IL, USA

27 papers at tracked venues · 23 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ProxyTTT: Proxy-driven Test-Time Training for Multi-modal Re-identification
  2. CaO2: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
  3. DKDM: Data-Free Knowledge Distillation for Diffusion Models with Any Architecture
  4. Distilling Long-tailed Datasets
  5. Efficient Multimodal Dataset Distillation via Generative Models
  6. Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model
  7. Intent3D: 3D Object Detection in RGB-D Scans Based on Human Intention
  8. LLaVA-Prumerge: Adaptive Token Reduction for Efficient Large Multimodal Models
  9. MaskSAM: Auto-Prompt SAM with Mask Classification for Volumetric Medical Image Segmentation
  10. Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
  11. QuEST: Low-Bit Diffusion Model Quantization via Efficient Selective Finetuning
  12. Robin3D Improving 3D Large Language Model via Robust Instruction Tuning
  13. Visual Grounding with Attention-Driven Constraint Balancing
  14. X-Field: A Physically Informed Representation for 3D X-ray Reconstruction
  15. Dataset Quantization with Active Learning Based Adaptive Sampling
  16. Efficient Multitask Dense Predictor via Binarization
  17. Enhancing Post-Training Quantization Calibration Through Contrastive Learning
  18. FBPT: A Fully Binary Point Transformer
  19. On the Faithfulness of Vision Transformer Explanations
  20. PTQ4DiT: Post-training Quantization for Diffusion Transformers
  21. Partially Aligned Cross-modal Retrieval via Optimal Transport-based Prototype Alignment Learning
  22. SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
  23. Semi-supervised Prototype Semantic Association Learning for Robust Cross-modal Retrieval
  24. Token Transformation Matters: Towards Faithful Post-Hoc Explanation for Vision Transformer
  25. Towards Accurate And Robust Dynamics and Reward Modeling for Model-Based Offline Inverse Reinforcement Learning
  26. Versatile Navigation Under Partial Observability via Value-Guided Diffusion Policy
  27. WaveFormer: Wavelet Transformer for Noise-Robust Video Inpainting