PPaperPicks

Wenxiang Guo

11 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Comprehensive Benchmarking of Long-Form Speech Generation in Diverse Scenarios
  2. Masked Text-to-Audio Flow-Matching and Reward Feedback Optimization
  3. A Multimodal Evaluation Framework for Spatial Audio Playback Systems: From Localization to Listener Preference
  4. ISDrama: Immersive Spatial Drama Generation through Multimodal Prompting
  5. MRSAudio: A Large-Scale Multimodal Recorded Spatial Audio Dataset with Refined Annotations
    NeurIPS 2025 · Wenxiang Guo
  6. STARS: A Unified Framework for Singing Transcription, Alignment, and Refined Style Annotation
    ACL 2025 · Wenxiang Guo
  7. TCSinger 2: Customizable Multilingual Zero-shot Singing Voice Synthesis
  8. TechSinger: Technique Controllable Multilingual Singing Voice Synthesis via Flow Matching
    AAAI 2025 · Wenxiang Guo
  9. Versatile Framework for Song Generation with Prompt-based Control
  10. Frieren: Efficient Video-to-Audio Generation Network with Rectified Flow Matching
  11. GTSinger: A Global Multi-Technique Singing Corpus with Realistic Music Scores for All Singing Tasks