PPaperPicks

Danda Pani Paudel

INSAIT, Sofia University "St. Kliment Ohridski", Bulgaria

37 papers at tracked venues · 28 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Autonomous Vehicle Path Planning by Searching with Differentiable Simulation
  2. EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question Answering
  3. RobustFormer: Noise-Robust Pre-training for Images and Videos
  4. Unlocking Efficient Vehicle Dynamics Modeling via Analytic World Models
  5. Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
  6. Autonomous Vehicle Controllers From End-to-End Differentiable Simulation
  7. Benchmarking Multi-modal Semantic Segmentation under Sensor Failures: Missing and Noisy Modality Robustness
  8. Complexity Experts are Task-Discriminative Learners for Any Image Restoration
  9. Diffusion-Based Particle-DETR for BEV Perception
  10. Domain-RAG: Retrieval-Guided Compositional Image Generation for Cross-Domain Few-Shot Object Detection
  11. Exploration-Driven Generative Interactive Environments
  12. Incremental Object Detection with Prompt-Based Methods
  13. LangHOPS: Language Grounded Hierarchical Open-Vocabulary Part Segmentation
  14. Leveraging Driver Field-of-View for Multimodal Ego-Trajectory Prediction
  15. Locate Anything on Earth: Advancing Open-Vocabulary Object Detection for Remote Sensing Community
  16. Low-Light Image Enhancement Using Event-Based Illumination Estimation
  17. NTIRE 2025 Challenge on Event-Based Image Deblurring: Methods and Results
  18. ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric Perspectives
  19. RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
  20. ReVLA: Reverting Visual Domain Limitation of Robotic Foundation Models
  21. Reducing Unimodal Bias in Multi-Modal Semantic Segmentation With Multi-Scale Functional Entropy Regularization
  22. SceneSplat++: A Large Dataset and Comprehensive Benchmark for Language Gaussian Splatting
  23. SceneSplat: Gaussian Splatting-Based Scene Understanding with Vision-Language Pretraining
  24. StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
  25. Understanding Museum Exhibits using Vision-Language Reasoning
  26. What You Have is What You Track: Adaptive and Robust Multimodal Tracking
  27. XTrack: Multimodal Training Boosts RGB-X Video Object Trackers
  28. A Unified and Interpretable Emotion Representation and Expression Generation
  29. Continuous Pose for Monocular Cameras in Neural Implicit Representation
  30. Event-Free Moving Object Segmentation from Moving Ego Vehicle
  31. ExtDM: Distribution Extrapolation Diffusion Model for Video Prediction
  32. Implicit Zoo: A Large-Scale Dataset of Neural Implicit Functions for 2D Images and 3D Scenes
  33. Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
  34. Single-Model and Any-Modality for Video Object Tracking
  35. Taming CLIP for Fine-Grained and Structured Visual Understanding of Museum Exhibits
  36. Ternary-Type Opacity and Hybrid Odometry for RGB NeRF-SLAM
  37. iHuman: Instant Animatable Digital Humans From Monocular Videos