PPaperPicks

Muhammad Haris Khan

41 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Balancing Multimodal Domain Generalization via Gradient Modulation and Projection
  2. BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
  3. DAMASHA: Detecting AI in Mixed Adversarial Texts via Segmentation with Human-interpretable Attribution
  4. FCC: Fully Connected Correlation for One-Shot Segmentation
  5. GCA Framework: A GCC Countries-Grounded Dataset and Agentic Pipeline for Climate Decision Support
  6. Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment Score
  7. VFace: A Training-Free Approach for Diffusion-Based Video Face Swapping
  8. microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
  9. AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations
  10. DPA: Dual Prototypes Alignment for Unsupervised Adaptation of Vision-Language Models
  11. Diffusion-Guided Graph Data Augmentation
  12. Divergent Domains, Convergent Grading: Enhancing Generalization in Diabetic Retinopathy Grading
  13. Domain-Guided Weight Modulation for Semi-Supervised Domain Generalization
    WACV 2025 ·
    Chamuditha Jayanga Galappaththige
  14. Dual-Stage Value-Guided Inference with Margin-Based Reward Adjustment for Fast and Faithful VLM Captioning
  15. FrogDogNet: Fourier frequency Retained visual prompt Output Guidance for Domain Generalization of CLIP in Remote Sensing
    CVPR 2025 ·
    Hariseetharam Gunduboina
  16. FusedVision: A Knowledge-Infusing Approach for Practical Anomaly Detection in Real-world Surveillance Videos
  17. Hyperbolic Uncertainty-Aware Few-Shot Incremental Point Cloud Segmentation
  18. ImpedanceGPT: VLM-driven Impedance Control of Swarm of Mini-drones for Intelligent Navigation in Dynamic Environment
  19. Industry 6.0: New Generation of Industry driven by Generative AI and Swarm of Heterogeneous Robots
  20. Leveraging 2D Priors and SDF Guidance for Dynamic Urban Scene Rendering
  21. MSAmba: Exploring Multimodal Sentiment Analysis with State Space Models
  22. O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
  23. OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP
  24. Realistic and Efficient Face Swapping: A Unified Approach with Diffusion Models
  25. SegMASt3R: Geometry Grounded Segment Matching
  26. SynFER: Towards Boosting Facial Expression Recognition With Synthetic Data
  27. TLAC: Two-stage LMM Augmented CLIP for Zero-Shot Classification
  28. The SignEval 2025 Challenge at the ICCV Multimodal Sign Language Recognition Workshop: Results and Discussion
  29. Towards Robust Multimodal Domain Generalization via Modality-Domain Joint Adversarial Training
  30. Towards Robust Training via Gradient-Diversified Backpropagation
  31. Unsupervised Discovery of Facial Landmarks and Head Pose
  32. A Synopsis of FAME 2024 Challenge: Associating Faces with Voices in Multilingual Environments
  33. Bird Whisperer: Leveraging Large Pre-trained Acoustic Model for Bird Call Classification
  34. Discrete Cycle-Consistency Based Unsupervised Deep Graph Matching
  35. Improving Single Domain-Generalized Object Detection: A Focus on Diversification and Alignment
  36. Leveraging Cycle-Consistent Anchor Points for Self-Supervised RGB-D Registration
  37. Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
  38. Pose-Guided Self-Training with Two-Stage Clustering for Unsupervised Landmark Discovery
  39. Towards Combating Frequency Simplicity-biased Learning for Domain Generalization
  40. Towards Generalizing to Unseen Domains with Few Labels
    CVPR 2024 ·
    Chamuditha Jayanga Galappaththige
  41. Why Not Use Your Textbook? Knowledge-Enhanced Procedure Planning of Instructional Videos
    CVPR 2024 ·
    Kumaranage Ravindu Yasas Nagasinghe