PPaperPicks

Naoki Makishima

6 papers at tracked venues · 2 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
  2. Multimodal Fine-Grained Apparent Personality Trait Recognition: Joint Modeling of Big Five and Questionnaire Item-level Scores
  3. SOMSRED-SVC: Sequential Output Modeling with Speaker Vector Constraints for Joint Multi-Talker Overlapped ASR and Speaker Diarization
    InterSpeech 2025 · Naoki Makishima
  4. Unified Audio-Visual Modeling for Recognizing Which Face Spoke When and What in Multi-Talker Overlapped Speech and Video
    InterSpeech 2025 · Naoki Makishima
  5. SOMSRED: Sequential Output Modeling for Joint Multi-talker Overlapped Speech Recognition and Speaker Diarization
    InterSpeech 2024 · Naoki Makishima
  6. Unified Multi-Talker ASR with and without Target-speaker Enrollment