PPaperPicks

Ryo Masumura

14 papers at tracked venues · 4 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
  2. Distribution Highlighted Reference-based Label Distribution Learning for Facial Age Estimation
  3. Leveraging LLMs for Written to Spoken Style Data Transformation to Enhance Spoken Dialog State Tracking
  4. MVTrajecter: Multi-View Pedestrian Tracking With Trajectory Motion Cost and Trajectory Appearance Cost
  5. Multimodal Fine-Grained Apparent Personality Trait Recognition: Joint Modeling of Big Five and Questionnaire Item-level Scores
    AAAI 2025 · Ryo Masumura
  6. SOMSRED-SVC: Sequential Output Modeling with Speaker Vector Constraints for Joint Multi-Talker Overlapped ASR and Speaker Diarization
  7. ToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind
  8. Unified Audio-Visual Modeling for Recognizing Which Face Spoke When and What in Multi-Talker Overlapped Speech and Video
  9. Boosting Hybrid Autoregressive Transducer-based ASR with Internal Acoustic Model Training and Dual Blank Thresholding
  10. Factor-Conditioned Speaking-Style Captioning
  11. Learning from Multiple Annotator Biased Labels in Multimodal Conversation
  12. Participant-Pair-Wise Bottleneck Transformer for Engagement Estimation from Video Conversation
  13. SOMSRED: Sequential Output Modeling for Joint Multi-talker Overlapped Speech Recognition and Speaker Diarization
  14. Unified Multi-Talker ASR with and without Target-speaker Enrollment
    InterSpeech 2024 · Ryo Masumura