PPaperPicks

Shentong Mo

14 papers at tracked venues · 10 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Foley-Flow: Coordinated Video-to-Audio Generation with Masked Audio-Visual Alignment and Dynamic Conditional Flows
    CVPR 2025 · Shentong Mo
  2. GMAIL: Generative Modality Alignment for generated Image Learning
    ICML 2025 · Shentong Mo
  3. Scaling Diffusion Mamba with Bidirectional SSMs for Efficient 3D Shape Generation
    AAAI 2025 · Shentong Mo
  4. The Dynamic Duo of Collaborative Masking and Target for Advanced Masked Autoencoder Learning
    AAAI 2025 · Shentong Mo
  5. pMoE: Prompting Diverse Experts Together Wins More in Visual Adaptation
    ICLR 2025 · Shentong Mo
  6. Aligning Audio-Visual Joint Representations with an Agentic Workflow
    NeurIPS 2024 · Shentong Mo
  7. Audio-Synchronized Visual Animation
  8. Audio-Visual Generalized Zero-Shot Learning the Easy Way
    ECCV 2024 · Shentong Mo
  9. Connecting Joint-Embedding Predictive Architecture with Contrastive Self-supervised Learning
    NeurIPS 2024 · Shentong Mo
  10. Continual Audio-Visual Sound Separation
  11. DailyMAE: Towards Pretraining Masked Autoencoders in One Day
  12. Fast Training of Diffusion Transformer with Extreme Masking for 3D Point Clouds Generation
    ECCV 2024 · Shentong Mo
  13. MA-AVT: Modality Alignment for Parameter-Efficient Audio-Visual Transformers
  14. Unveiling the Power of Audio-Visual Early Fusion Transformers with Dense Interactions Through Masked Modeling
    CVPR 2024 · Shentong Mo