PPaperPicks

Yuhang Ma

9 papers at tracked venues · 7 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
  2. Few-Shot Incremental Multi-modal Learning via Touch Guidance and Imaginary Vision Synthesis
  3. HPSv3: Towards Wide-Spectrum Human Preference Score
    ICCV 2025 · Yuhang Ma
  4. LLM4GEN: Leveraging Semantic Representation of LLMs for Text-to-Image Generation
  5. MelRe: Vision-Based Mel-Spectrogram Restoration
  6. Multimodal Conditional Retrieval with High Controllability
  7. PlanGen: Towards Unified Layout Planning and Image Generation in Auto-Regressive Vision Language Models
  8. Storynizor: Consistent Story Generation via Inter-Frame Synchronized and Shuffled ID Injection
    AAAI 2025 · Yuhang Ma
  9. HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation