PPaperPicks

Mingxiang Cao

6 papers at tracked venues · 6 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. TOP-RL: Task-Optimized Progressive Token Pruning with Reinforcement Learning for Vision Language Models
  2. DiffCLIP: Few-shot Language-driven Multimodal Classifier
  3. FusionSAM: Visual Multi-Modal Learning with Segment Anything Model
  4. Towards Long-Horizon Vision-Language-Action System: Reasoning, Acting and Memory
  5. Uni-Sight: An E2E Vision-Language-Action System Unifying Multi-View Alignment and Multi-Modal Fusion
  6. E2E-MFD: Towards End-to-End Synchronous Multimodal Fusion Detection