PPaperPicks

Chang D. Yoo

30 papers at tracked venues · 18 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. A Gradient Guidance Perspective on Stepwise Preference Optimization for Diffusion Models
  2. Can Video LLMs Refuse to Answer? Alignment for Answerability in Video Large Language Models
  3. ConfPO: Exploiting Policy Model Confidence for Critical Token Selection in Preference Optimization
  4. Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
  5. FlowDrag: 3D-aware Drag-based Image Editing with Mesh-guided Deformation Vector Flow Fields
  6. Human-Centric AI: From Explainability and Trustworthiness to Actionable Ethics
  7. ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On
  8. MDSGen: Fast and Efficient Masked Diffusion Temporal-Aware Transformers for Open-Domain Sound Generation
  9. Occlusion-Robust Stylization for Drawing-Based 3D Animation
  10. Policy Learning from Large Vision-Language Model Feedback Without Reward Modeling
  11. SiamCTC: Learning Speech Representations through Monotonic Temporal Alignment
  12. TARO: Timestep-Adaptive Representation Alignment with Onset-Aware Conditioning for Synchronized Video-To-Audio Synthesis
  13. The Interspeech 2025 Speech Accessibility Project Challenge
  14. BI-MDRG: Bridging Image History in Multimodal Dialogue Response Generation
  15. C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature Dispersion
  16. Cross-view Masked Diffusion Transformers for Person Image Synthesis
  17. DNI: Dilutional Noise Initialization for Diffusion Video Editing
  18. FRAG: Frequency Adapting Group for Diffusion Video Editing
  19. FlexiEdit: Frequency-Aware Latent Refinement for Enhanced Non-rigid Editing
  20. Implicit Steganography Beyond the Constraints of Modality
  21. LI-TTA: Language Informed Test-Time Adaptation for Automatic Speech Recognition
  22. Mitigating Adversarial Perturbations for Deep Reinforcement Learning via Vector Quantization
  23. Predictive Coding for Decision Transformer
  24. Progressive Fourier Neural Representation for Sequential Video Compilation
  25. Query-based Cross-Modal Projector Bolstering Mamba Multimodal LLM
  26. Querying Easily Flip-flopped Samples for Deep Active Learning
  27. SimPSI: A Simple Strategy to Preserve Spectral Information in Time Series Data Augmentation
  28. TLCR: Token-Level Continuous Reward for Fine-grained Reinforcement Learning from Human Feedback
  29. TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation
  30. Zero-Shot Dual-Path Integration Framework for Open-Vocabulary 3D Instance Segmentation