P
PaperPicks
Conferences
Ziyue Jiang
Zhejiang University, Hangzhou, China
21 papers at tracked venues · 15 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Google Scholar ↗
Venues
ACL
×7
EMNLP
×3
ICLR
×3
InterSpeech
×3
NeurIPS
×2
AAAI
×1
ACM MM
×1
ICML
×1
Frequent coauthors
Yu Zhang
DBLP profile ↗
ORCID search ↗
×4
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
×3
Rongjie Huang
DBLP profile ↗
ORCID search ↗
×3
Qian Yang
DBLP profile ↗
ORCID search ↗
×2
Zhenhui Ye
DBLP profile ↗
ORCID search ↗
×2
Changhao Pan
DBLP profile ↗
ORCID search ↗
×1
Yanru Huo
DBLP profile ↗
ORCID search ↗
×1
Jiaqi Duan
DBLP profile ↗
ORCID search ↗
×1
Kaidi Wang
DBLP profile ↗
ORCID search ↗
×1
Jialong Zuo
DBLP profile ↗
ORCID search ↗
×1
Rui Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Comprehensive Benchmarking of Long-Form Speech Generation in Diverse Scenarios
ACL 2026
·
Changhao Pan
DBLP profile ↗
ORCID search ↗
DiTReducio: A Training-Free Acceleration for DiT-Based TTS via Progressive Calibration
ACL 2026
·
Yanru Huo
DBLP profile ↗
ORCID search ↗
BrainLoc: Brain Signal-Based Object Detection with Multi-modal Alignment
EMNLP 2025
·
Jiaqi Duan
DBLP profile ↗
ORCID search ↗
Discl-VC: Disentangled Discrete Tokens and In-Context Learning for Controllable Zero-Shot Voice Conversion
InterSpeech 2025
·
Kaidi Wang
DBLP profile ↗
ORCID search ↗
Rhythm Controllable and Efficient Zero-Shot Voice Conversion via Shortcut Flow Matching
ACL 2025
·
Jialong Zuo
DBLP profile ↗
ORCID search ↗
Speech Watermarking with Discrete Intermediate Representations
AAAI 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
TCSinger 2: Customizable Multilingual Zero-shot Singing Voice Synthesis
ACL 2025
·
Yu Zhang
DBLP profile ↗
ORCID search ↗
Versatile Framework for Song Generation with Prompt-based Control
EMNLP 2025
·
Yu Zhang
DBLP profile ↗
ORCID search ↗
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
ICLR 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
ACL 2024
·
Qian Yang
DBLP profile ↗
ORCID search ↗
FluentEditor: Text-based Speech Editing by Considering Acoustic and Prosody Consistency
InterSpeech 2024
·
Rui Liu
DBLP profile ↗
ORCID search ↗
GTSinger: A Global Multi-Technique Singing Corpus with Realistic Music Scores for All Singing Tasks
NeurIPS 2024
·
Yu Zhang
DBLP profile ↗
ORCID search ↗
InstructSpeech: Following Speech Editing Instructions via Large Language Models
ICML 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗
MSceneSpeech: A Multi-Scene Speech Dataset For Expressive Speech Synthesis
InterSpeech 2024
·
Qian Yang
DBLP profile ↗
ORCID search ↗
Make-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners
ACL 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗
Mega-TTS 2: Boosting Prompting Mechanisms for Zero-Shot Speech Synthesis
ICLR 2024
·
Ziyue Jiang
MimicTalk: Mimicking a personalized and expressive 3D talking face in minutes
NeurIPS 2024
·
Zhenhui Ye
DBLP profile ↗
ORCID search ↗
MobileSpeech: A Fast and High-Fidelity Framework for Mobile Zero-Shot Text-to-Speech
ACL 2024
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
ICLR 2024
·
Zhenhui Ye
DBLP profile ↗
ORCID search ↗
TCSinger: Zero-Shot Singing Voice Synthesis with Style Transfer and Multi-Level Style Control
EMNLP 2024
·
Yu Zhang
DBLP profile ↗
ORCID search ↗
VoiceTuner: Self-Supervised Pre-training and Efficient Fine-tuning For Voice Generation
ACM MM 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗