PPaperPicks

Huimin Ma

University of Science and Technology, School of Computer and Commuication Engineering, Beijing, China

23 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bridging the Temporal Gap in Multimodal LLMs: Deeply Stacking Temporal Tokens for Audio-Visual Speech Recognition
  2. AGC-Drive: A Large-Scale Dataset for Real-World Aerial-Ground Collaboration in Driving Scenarios
  3. A²RNet: Adversarial Attack Resilient Network for Robust Infrared and Visible Image Fusion
  4. Boosting Micro-Expression Analysis via Prior-Guided Video-Level Regression
  5. DADet: Safeguarding Image Conditional Diffusion Models Against Adversarial and Backdoor Attacks via Diffusion Anomaly Detection
  6. From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models
  7. Image-to-video Adaptation with Outlier Modeling and Robust Self-learning
  8. Kaleidoscopic Background Attack: Disrupting Pose Estimation With Multi-Fold Radial Symmetry Textures
  9. MVSMamba: Multi-View Stereo with State Space Model
  10. MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
  11. ProtoCar: Learning 3D Vehicle Prototypes from Single-View and Unconstrained Driving Scene Images
  12. RRT-MVS: Recurrent Regularization Transformer for Multi-View Stereo
  13. RhythmMamba: Fast, Lightweight, and Accurate Remote Physiological Measurement
  14. SAM2Object: Consolidating View Consistency via SAM2 for Zero-Shot 3D Instance Segmentation
  15. Affinity3D: Propagating Instance-Level Semantic Affinity for Zero-Shot Point Cloud Semantic Segmentation
  16. CMT: Co-training Mean-Teacher for Unsupervised Domain Adaptation on 3D Object Detection
  17. ODGEN: Domain-specific Object Detection Data Generation with Diffusion Models
  18. Step Vulnerability Guided Mean Fluctuation Adversarial Attack against Conditional Diffusion Models
  19. Transferable Adversarial Attacks for Object Detection Using Object-Aware Significant Feature Distortion
  20. Unlocking Attributes' Contribution to Successful Camouflage: A Combined Textual and Visual Analysis Strategy
  21. Unsupervised Image-to-Video Adaptation via Category-aware Flow Memory Bank and Realistic Video Generation
  22. Unveiling the Dynamics of Information Interplay in Supervised Learning
  23. Upper-Body Hierarchical Graph for Skeleton Based Emotion Recognition in Assistive Driving