PPaperPicks

Zhiyuan Ma

Tsinghua University, Department of Electronic Engineering, Beijing, China

15 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. I2E: From Image Pixels to Actionable Interactive Environments for Text-Guided Image Editing
  2. MIDE: Multimodal Dialogue Emotion Recognition via Mutual Information Enhancement and Dynamic Modality Selection
  3. OPERA: A Reinforcement Learning-Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
  4. UTAG: Leveraging LLM as a Unified Embedding Generator for Text-Attributed Graphs
  5. DreamAlign: Dynamic Text-to-3D Optimization with Human Preference Alignment
  6. Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
  7. SAKR-Edit: Scene-Aware Knowledge Reasoning for Text-to-Image Editing
  8. TTRL: Test-Time Reinforcement Learning
  9. AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing
    AAAI 2024 · Zhiyuan Ma
  10. Exploring Adversarial Robustness of Deep State Space Models
  11. Generative Multi-Modal Knowledge Retrieval with Large Language Models
  12. LMD: Faster Image Reconstruction with Latent Masking Diffusion
    AAAI 2024 · Zhiyuan Ma
  13. Neural Residual Diffusion Models for Deep Scalable Vision Generation
    NeurIPS 2024 · Zhiyuan Ma
  14. Safe-SD: Safe and Traceable Stable Diffusion with Text Prompt Trigger for Invisible Generative Watermarking
    ACM MM 2024 · Zhiyuan Ma
  15. UltraMedical: Building Specialized Generalists in Biomedicine