PPaperPicks

Sung-Bin Kim

9 papers at tracked venues · 6 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter
  2. AVHBench: A Cross-Modal Hallucination Benchmark for Audio-Visual Large Language Models
    ICLR 2025 · Sung-Bin Kim
  3. AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation
  4. Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics
  5. SoundBrush: Sound as a Brush for Visual Scene Editing
    AAAI 2025 · Sung-Bin Kim
  6. VoiceCraft-Dub: Automated Video Dubbing with Neural Codec Language Models
    ICCV 2025 · Sung-Bin Kim
  7. Enhancing Speech-Driven 3D Facial Animation with Audio-Visual Guidance from Lip Reading Expert
  8. MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
    InterSpeech 2024 · Sung-Bin Kim
  9. SMILE: Multimodal Dataset for Understanding Laughter in Video with Language Models