PPaperPicks

Chao Ma

Shanghai Jiao Tong University, AI Institute, MOE Key Lab of Artificial Intelligence, Shanghai, China

35 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Latent Knowledge-Guided Video Diffusion for Scientific Phenomena Generation from a Single Initial Frame
  2. Parameter-Free Fine-tuning via Redundancy Elimination for Vision Foundation Models
  3. A Simple Approach to Unifying Diffusion-based Conditional Generation
  4. AnchorSync: Global Consistency Optimization for Long Video Editing
  5. Bi-Stream Knowledge Transfer for Semi-Supervised 3D Point Cloud Object Detection
  6. CDUPatch: Color-Driven Universal Adversarial Patch Attack for Dual-Modal Visible-Infrared Detectors
  7. Correlated Low-Rank Adaptation for ConvNets
  8. Cross-Architecture Distillation Made Simple with Redundancy Suppression
  9. Domain Prompt Learning with Quaternion Networks (Extended Abstract)
  10. HaWoR: World-Space Hand Motion Reconstruction from Egocentric Videos
  11. PVMamba: Parallelizing Vision Mamba via Dynamic State Aggregation
  12. Robust SAM: On the Adversarial Robustness of Vision Foundation Models
  13. S3-Face: SSS-Compliant Facial Reflectance Estimation via Diffusion Priors
  14. Towards Generalized Face Anti-Spoofing from a Frequency Shortcut View
  15. VRM: Knowledge Distillation via Virtual Relation Matching
  16. VTimeCoT: Thinking by Drawing for Video Temporal Grounding and Reasoning
  17. What You Have is What You Track: Adaptive and Robust Multimodal Tracking
  18. XTrack: Multimodal Training Boosts RGB-X Video Object Trackers
  19. Cross-View Consistency Regularisation for Knowledge Distillation
  20. DiffusionTrack: Point Set Diffusion Model for Visual Object Tracking
  21. Domain-Controlled Prompt Learning
  22. LERE: Learning-Based Low-Rank Matrix Recovery with Rank Estimation
  23. Monocular Identity-Conditioned Facial Reflectance Reconstruction
  24. NeuMA: Neural Material Adaptor for Visual Grounding of Intrinsic Dynamics
  25. OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
  26. PapMOT: Exploring Adversarial Patch Attack Against Multiple Object Tracking
  27. Prompt Learning with Quaternion Networks
  28. QuadMamba: Learning Quadtree-based Selective Scan for Visual State Space Model
  29. SaccadeDet: A Novel Dual-Stage Architecture for Rapid and Accurate Detection in Gigapixel Images
  30. SaccadeMOT: Enhancing Object Detection and Tracking in Gigapixel Images via Scale-Aware Density Estimation
  31. Single-Model and Any-Modality for Video Object Tracking
  32. SparseFormer: Detecting Objects in HRW Shots via Sparse Vision Transformer
  33. SparseOcc: Rethinking Sparse Latent Representation for Vision-Based Semantic Occupancy Prediction
  34. VEON: Vocabulary-Enhanced Occupancy Prediction
  35. VidToMe: Video Token Merging for Zero-Shot Video Editing