P
PaperPicks
Conferences
Jialong Zuo
23 papers at tracked venues · 19 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0009-0002-6876-9943 ↗
Homepage ↗
Venues
ACL
×5
NeurIPS
×4
AAAI
×3
InterSpeech
×3
ACM MM
×2
CVPR
×2
ICLR
×2
EMNLP
×1
ICCV
×1
Frequent coauthors
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
×5
Minghui Fang
DBLP profile ↗
ORCID search ↗
×2
Xiaoda Yang
DBLP profile ↗
ORCID search ↗
×2
Wenti Yin
DBLP profile ↗
ORCID search ↗
×1
Huaxin Zhang
DBLP profile ↗
ORCID search ↗
×1
Kaixuan Luan
DBLP profile ↗
ORCID search ↗
×1
Xize Cheng
DBLP profile ↗
ORCID search ↗
×1
Dongyue Wu
DBLP profile ↗
ORCID search ↗
×1
Wenrui Liu
DBLP profile ↗
ORCID search ↗
×1
Qian Yang
DBLP profile ↗
ORCID search ↗
×1
Papers
Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic Alignment
AAAI 2026
·
Wenti Yin
DBLP profile ↗
ORCID search ↗
CART: A Generative Cross-Modal Retrieval Framework With Coarse-To-Fine Semantic Modeling
ACL 2025
·
Minghui Fang
DBLP profile ↗
ORCID search ↗
ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control
ACL 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
GTA: Towards Generative Text-To-Audio Retrieval via Multi-Scale Tokenizer
InterSpeech 2025
·
Minghui Fang
DBLP profile ↗
ORCID search ↗
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
CVPR 2025
·
Huaxin Zhang
DBLP profile ↗
ORCID search ↗
L-Man: A Large Multi-modal Model Unifying Human-centric Tasks
AAAI 2025
·
Jialong Zuo
Language-Codec: Bridging Discrete Codec Representations and Speech Language Models
ACL 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
MelRe: Vision-Based Mel-Spectrogram Restoration
InterSpeech 2025
·
Kaixuan Luan
DBLP profile ↗
ORCID search ↗
OmniSep: Unified Omni-Modality Sound Separation with Query-Mixup
ICLR 2025
·
Xize Cheng
DBLP profile ↗
ORCID search ↗
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
ICCV 2025
·
Dongyue Wu
DBLP profile ↗
ORCID search ↗
ReID5o: Achieving Omni Multi-modal Person Re-identification in a Single Model
NeurIPS 2025
·
Jialong Zuo
Rhythm Controllable and Efficient Zero-Shot Voice Conversion via Shortcut Flow Matching
ACL 2025
·
Jialong Zuo
Speech Token Prediction via Compressed-to-fine Language Modeling for Speech Generation
ACM MM 2025
·
Wenrui Liu
DBLP profile ↗
ORCID search ↗
Speech Watermarking with Discrete Intermediate Representations
AAAI 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
VideoLucy: Deep Memory Backtracking for Long Video Understanding
NeurIPS 2025
·
Jialong Zuo
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
ICLR 2025
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
AudioVSR: Enhancing Video Speech Recognition with Audio Data
EMNLP 2024
·
Xiaoda Yang
DBLP profile ↗
ORCID search ↗
Cross-video Identity Correlating for Person Re-identification Pre-training
NeurIPS 2024
·
Jialong Zuo
MSceneSpeech: A Multi-Scene Speech Dataset For Expressive Speech Synthesis
InterSpeech 2024
·
Qian Yang
DBLP profile ↗
ORCID search ↗
MobileSpeech: A Fast and High-Fidelity Framework for Mobile Zero-Shot Text-to-Speech
ACL 2024
·
Shengpeng Ji
DBLP profile ↗
ORCID search ↗
PLIP: Language-Image Pre-training for Person Representation Learning
NeurIPS 2024
·
Jialong Zuo
SyncTalklip: Highly Synchronized Lip-Readable Speaker Generation with Multi-Task Learning
ACM MM 2024
·
Xiaoda Yang
DBLP profile ↗
ORCID search ↗
UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity
CVPR 2024
·
Jialong Zuo