P
PaperPicks
Conferences
Yongqi Wang
22 papers at tracked venues · 20 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID search ↗
Venues
CVPR
×8
ACL
×5
AAAI
×2
NeurIPS
×2
ACM MM
×1
ICML
×1
IJCAI
×1
NAACL
×1
VLDB
×1
Frequent coauthors
Jun Yu
DBLP profile ↗
ORCID search ↗
×7
Rongjie Huang
DBLP profile ↗
ORCID search ↗
×3
Ruiqi Li
DBLP profile ↗
ORCID search ↗
×2
Haoze Song
DBLP profile ↗
ORCID search ↗
×1
Xilong Lu
DBLP profile ↗
ORCID search ↗
×1
Wenxiang Guo
DBLP profile ↗
ORCID search ↗
×1
Fuming You
DBLP profile ↗
ORCID search ↗
×1
Shuo Yang
DBLP profile ↗
ORCID search ↗
×1
Zhiqing Hong
DBLP profile ↗
ORCID search ↗
×1
Papers
Cross-Modal Facial Expression Recognition with Global Channel-Spatial Attention: Modal Enhancement and Proportional Criterion Fusion
CVPR 2025
·
Jun Yu
DBLP profile ↗
ORCID search ↗
Dual-Stage Cross-Modal Network with Dynamic Feature Fusion for Emotional Mimicry Intensity Estimation
CVPR 2025
·
Jun Yu
DBLP profile ↗
ORCID search ↗
Interactive Multimodal Framework with Temporal Modeling for Emotion Recognition
CVPR 2025
·
Jun Yu
DBLP profile ↗
ORCID search ↗
K2: On Optimizing Distributed Transactions in a Multi-region Data Store with True-time Clocks
VLDB 2025
·
Haoze Song
DBLP profile ↗
ORCID search ↗
METOR: A Unified Framework for Mutual Enhancement of Objects and Relationships in Open-vocabulary Video Visual Relationship Detection
IJCAI 2025
·
Yongqi Wang
Robust Stage-Wise LVLM Adaptation: Multi-Phase Prompt Lora Fine-tuning for Compound Expression Recognition
CVPR 2025
·
Xilong Lu
DBLP profile ↗
ORCID search ↗
TechSinger: Technique Controllable Multilingual Singing Voice Synthesis via Flow Matching
AAAI 2025
·
Wenxiang Guo
DBLP profile ↗
ORCID search ↗
Towards Robust Multimodal AU Detection: STN-Enhanced Visual Encoding and Audio-Visual Spatial-Temporal Alignment
CVPR 2025
·
Jun Yu
DBLP profile ↗
ORCID search ↗
AUD-TGN: Advancing Action Unit Detection with Temporal Convolution and GPT-2 in Wild Audiovisual Contexts
CVPR 2024
·
Jun Yu
DBLP profile ↗
ORCID search ↗
Exploring Facial Expression Recognition through Semi-Supervised Pre-training and Temporal Modeling
CVPR 2024
·
Jun Yu
DBLP profile ↗
ORCID search ↗
Frieren: Efficient Video-to-Audio Generation Network with Rectified Flow Matching
NeurIPS 2024
·
Yongqi Wang
Improving Valence-Arousal Estimation with Spatiotemporal Relationship Learning and Multimodal Fusion
CVPR 2024
·
Jun Yu
DBLP profile ↗
ORCID search ↗
InstructSpeech: Following Speech Editing Instructions via Large Language Models
ICML 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗
Make-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners
ACL 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗
MoMu-Diffusion: On Learning Long-Term Motion-Music Synchronization and Correspondence
NeurIPS 2024
·
Fuming You
DBLP profile ↗
ORCID search ↗
Multi-Modal Prompting for Open-Vocabulary Video Visual Relationship Detection
AAAI 2024
·
Shuo Yang
DBLP profile ↗
ORCID search ↗
Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language Prompt
NAACL 2024
·
Yongqi Wang
Robust Singing Voice Transcription Serves Synthesis
ACL 2024
·
Ruiqi Li
DBLP profile ↗
ORCID search ↗
Self-Supervised Singing Voice Pre-Training towards Speech-to-Singing Conversion
ACL 2024
·
Ruiqi Li
DBLP profile ↗
ORCID search ↗
Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
ACL 2024
·
Yongqi Wang
Text-to-Song: Towards Controllable Music Generation Incorporating Vocal and Accompaniment
ACL 2024
·
Zhiqing Hong
DBLP profile ↗
ORCID search ↗
VoiceTuner: Self-Supervised Pre-training and Efficient Fine-tuning For Voice Generation
ACM MM 2024
·
Rongjie Huang
DBLP profile ↗
ORCID search ↗