PPaperPicks

Yong Ren

12 papers at tracked venues · 7 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. ALLM4ADD: Unlocking the Capabilities of Audio Large Language Models for Audio Deepfake Detection
  2. AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language Models
  3. Enhancing Multimodal Continual Instruction Tuning with BranchLoRA
  4. Hearing from Silence: Reasoning Audio Descriptions from Silent Videos via Vision-Language Model
    InterSpeech 2025 · Yong Ren
  5. Mitigating Audiovisual Mismatch in Visual-Guide Audio Captioning
  6. Progressive LoRA for Multimodal Continual Instruction Tuning
  7. Region-Based Optimization in Continual Learning for Audio Deepfake Detection
  8. Towards Diverse and Efficient Audio Captioning via Diffusion Models
  9. Residual Speaker Representation for One-Shot Voice Conversion
  10. SpikeVoice: High-Quality Text-to-Speech Via Efficient Spiking Neural Network
  11. TraceableSpeech: Towards Proactively Traceable Text-to-Speech with Watermarking
  12. Utilizing Speaker Profiles for Impersonation Audio Detection