PPaperPicks

Enze Xie

21 papers at tracked venues · 18 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. DC-AE 1.5: Accelerating Diffusion Model Convergence with Structured Latent Space
  2. DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
  3. Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
  4. HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
  5. SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer
    ICML 2025 · Enze Xie
  6. SANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation
  7. SANA: Efficient High-Resolution Text-to-Image Synthesis with Linear Diffusion Transformers
    ICLR 2025 · Enze Xie
  8. SVDQuant: Absorbing Outliers by Low-Rank Component for 4-Bit Diffusion Models
  9. SplatMesh: Interactive 3D Segmentation and Editing Using Mesh-Based Gaussian Splatting
  10. VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation
  11. Accelerating Diffusion Sampling with Optimized Time Steps
  12. DQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context Learning
  13. DeepAccident: A Motion and Accident Prediction Benchmark for V2X Autonomous Driving
  14. Fast Training of Diffusion Transformer with Extreme Masking for 3D Point Clouds Generation
  15. GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation
  16. LEGO-Prover: Neural Theorem Proving with Growing Libraries
  17. Large Language Models as Automated Aligners for benchmarking Vision-Language Models
  18. MagicDrive: Street View Generation with Diverse 3D Geometry Control
  19. PIXART-Σ: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation
  20. PixArt-α: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis
  21. Segment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts