PPaperPicks

Zicheng Liu

Microsoft Research, Redmond, WA, USA

28 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AdaptEvolve: Improving Efficiency of Evolutionary AI Agents through Adaptive Model Selection
  2. Conditional Text-to-Image Generation with Reference Guidance
  3. DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning
  4. Reliable Use of Lemmas via Eligibility Reasoning and Section-Aware Reinforcement Learning
  5. Stabilizing Efficient Reasoning with Step-Level Advantage Selection
  6. Agent Laboratory: Using LLM Agents as Research Assistants
  7. Exploring Invariance in Images through One-way Wave Equations
  8. Masked Autoencoders Are Effective Tokenizers for Diffusion Models
  9. Self-Taught Agentic Long Context Understanding
  10. SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer
  11. TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games
  12. TaDA: Training-free recipe for Decoding with Adaptive KV Cache Compression and Mean-centering
  13. Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization
  14. Unleashing Hour-Scale Video Training for Long Video-Language Understanding
  15. Bring Metric Functions into Diffusion Models
  16. Completing Visual Objects via Bridging Generation and Segmentation
  17. Disco: Disentangled Control for Realistic Human Dance Generation
  18. GRiT: A Generative Region-to-Text Transformer for Object Understanding
  19. IDOL: Unified Dual-Modal Latent Diffusion for Human-Centric Joint Video-Depth Generation
  20. Idea2Img: Iterative Self-refinement with GPT-4V for Automatic Image Design and Generation
  21. MM-Narrator: Narrating Long-form Videos with Multimodal In-Context Learning
  22. MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities
  23. ORES: Open-Vocabulary Responsible Visual Synthesis
  24. OpenLEAF: A Novel Benchmark for Open-Domain Interleaved Image-Text Generation
  25. Segment and Caption Anything
  26. StrokeNUWA - Tokenizing Strokes for Vector Graphic Synthesis
  27. Taming Diffusion Prior for Image Super-Resolution with Domain Shift SDEs
  28. Training Diffusion Models Towards Diverse Image Generation with Reinforcement Learning