PPaperPicks

Gang Hua

Amazon, Bellevue, WA, USA

23 papers at tracked venues · 19 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Efficient LLM-Jailbreaking via Multimodal-LLM Jailbreak
  2. RayD3D: Distilling Depth Knowledge Along the Ray for Robust Multi-View 3D Object Detection
  3. Boosting Point-Supervised Temporal Action Localization through Integrating Query Reformation and Optimal Transport
  4. Class-aware Domain Knowledge Fusion and Fission for Continual Test-Time Adaptation
  5. Componential Prompt-Knowledge Alignment for Domain Incremental Learning
  6. Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
  7. DynaRend: Learning 3D Dynamics via Masked Future Rendering for Robotic Manipulation
  8. Jigsaw++: Imagining Complete Shape Priors for Object Reassembly
  9. Moment Quantization for Video Temporal Grounding
  10. SAMPO: Scale-wise Autoregression with Motion Prompt for Generative World Models
  11. State Space Prompting via Gathering and Spreading Spatio-Temporal Information for Video Understanding
  12. Token Coordinated Prompt Attention is Needed for Visual Prompting
  13. Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion
  14. DL3DV-10K: A Large-Scale Scene Dataset for Deep Learning-based 3D Vision
  15. Enhancing Implicit Shape Generators Using Topological Regularizations
  16. Evidential Active Recognition: Intelligent and Prudent Open-World Embodied Perception
  17. Exploring Pre-trained Text-to-Video Diffusion Models for Referring Video Object Segmentation
  18. Learning Anomalies with Normality Prior for Unsupervised Video Anomaly Detection
  19. Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
  20. Stepwise Multi-grained Boundary Detector for Point-Supervised Temporal Action Localization
  21. Temporal Correlation Vision Transformer for Video Person Re-Identification
  22. Towards Generalizable Multi-Object Tracking
  23. UGG: Unified Generative Grasping