PPaperPicks

Yan Huang

11 papers at tracked venues · 8 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Gait Transformer: End-to-End Transformer Backbone for Gait Recognition
  2. BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
  3. EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow
  4. Frequency-Domain Multi-modal Fusion for Language-Guided Medical Image Segmentation
  5. Glance2Gaze: Efficient Vision-Language Models from Glance Fusion to Gaze Compression
  6. Learning Fine-Grained Alignment for Aerial Vision-Dialog Navigation
  7. SPENet: Self-guided Prototype Enhancement Network for Few-Shot Medical Image Segmentation
  8. VicKAM: Visual Conceptual Knowledge Guided Action Map for Weakly Supervised Group Activity Recognition
  9. Everyday Object Meets Vision-and-Language Navigation Agent via Backdoor
  10. Free Lunch for Gait Recognition: A Novel Relation Descriptor
  11. Investigating Compositional Challenges in Vision-Language Models for Visual Grounding