PPaperPicks

Hisham Cholakkal

31 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MedROV: Towards Real-Time Open-Vocabulary Detection Across Diverse Medical Imaging Modalities
  2. Paper Circle: An Open-source Multi-agent Research Discovery and Analysis Framework
  3. Think Before You Segment: An Object-aware Reasoning Agent for Referring Audio-Visual Segmentation
  4. A Culturally-diverse Multilingual Multimodal Video Benchmark & Model
  5. Adapting In-Domain Few-Shot Segmentation to New Domains Without Source Domain Retraining
  6. AgroGPT : Efficient Agricultural Vision-Language Model with Expert Tuning
  7. All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages
  8. BiMediX2 : Bio-Medical EXpert LMM for Diverse Medical Modalities
  9. DEFT: Decompositional Efficient Fine-Tuning for Text-to-Image Models
  10. DriveLMM-o1: A Step-by-Step Reasoning Dataset and Large Multimodal Model for Driving Scenario Understanding
  11. Fann or Flop: A Multigenre, Multiera Benchmark for Arabic Poetry Understanding in LLMs
  12. LLMVoX: Autoregressive Streaming Text-to-Speech Model for Any LLM
  13. LlamaV-o1: Rethinking Step-by-step Visual Reasoning in LLMs
  14. MAviS: A Multimodal Conversational Assistant For Avian Species
  15. MedAgentSim: Self-evolving Multi-agent Simulations for Realistic Clinical Interactions
    MICCAI 2025 ·
    Mohammed Khaleed Almansoori
  16. Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
    ICLR 2025 ·
    Mohamed El Amine Boudjoghra
  17. Open3DTrack: Towards Open-Vocabulary 3D Multi-Object Tracking
  18. Palo: A Polyglot Large Multimodal Model for 5B People
  19. TAViS: Text-bridged Audio-Visual Segmentation with Foundation Models
  20. Time Travel: A Comprehensive Benchmark to Evaluate LMMs on Historical and Cultural Artifacts
  21. BiMediX: Bilingual Medical Mixture of Experts LLM
  22. Bidirectional Reciprocative Information Communication for Few-Shot Semantic Segmentation
  23. CONDA: Condensed Deep Association Learning for Co-salient Object Detection
  24. Continual Learning and Unknown Object Discovery in 3D Scenes via Self-distillation
    ECCV 2024 ·
    Mohamed El Amine Boudjoghra
  25. Decoupled Training for Semi-supervised Medical Image Segmentation with Worst-Case-Aware Learning
  26. Efficient 3D-Aware Facial Image Editing via Attribute-Specific Prompt Learning
  27. GLaMM: Pixel Grounding Large Multimodal Model
  28. Long-Tailed 3D Semantic Segmentation with Adaptive Weight Constraint and Sampling
  29. PARIS3D: Reasoning-Based 3D Part Segmentation Using Large Multimodal Model
  30. Rethinking Transformers Pre-training for Multi-Spectral Satellite Imagery
  31. Semi-supervised Open-World Object Detection