PPaperPicks

Daiki Shimada

3 papers at tracked venues · 3 at CORE A* · active 20252026

Venues

Frequent coauthors

Papers

  1. Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting
  2. Empowering LLMs with Pseudo-Untrimmed Videos for Audio-Visual Temporal Understanding
  3. Rethinking Audio-Visual Adversarial Vulnerability from Temporal and Modality Perspectives