PPaperPicks

Xuefei Ning

25 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GENMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
  2. How Quantization Shapes Bias in Large Language Models
  3. Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
  4. AgentSociety Challenge: Designing LLM Agents for User Modeling and Recommendation on Web Platforms
  5. Decouple-Then-Merge: Finetune Diffusion Models as Multi-Task Learning
  6. Distilled Decoding 1: One-step Sampling of Image Auto-regressive Models with Flow Matching
  7. Distilled Decoding 2: One-step Sampling of Image Auto-regressive Models with Conditional Score Distillation
  8. Efficient Inference for Large Language Models -Algorithm, Model, and System
    EMNLP 2025 · Xuefei Ning
  9. FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models
  10. Latent Zoning Network: A Unified Principle for Generative Modeling, Representation Learning, and Classification
  11. Linear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better
  12. MBQ: Modality-Balanced Quantization for Large Vision-Language Models
  13. ProReflow: Progressive Reflow with Decomposed Velocity
  14. SOLA: Optimizing SLO Attainment for Large Language Model Serving with State-Aware Scheduling
  15. Training-Free and Hardware-Friendly Acceleration for Diffusion Models via Similarity-based Token Pruning
  16. ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
  17. A Unified Sampling Framework for Solver Searching of Diffusion Probabilistic Models
  18. Can LLMs Learn by Teaching for Better Reasoning? A Preliminary Study
    NeurIPS 2024 · Xuefei Ning
  19. DiTFastAttn: Attention Compression for Diffusion Transformer Models
  20. Evaluating Quantized Large Language Models
  21. FlashEval: Towards Fast and Accurate Evaluation of Text-to-Image Diffusion Generative Models
  22. MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
  23. Rad-NeRF: Ray-decoupled Training of Neural Radiance Field
  24. Rescaling Intermediate Features Makes Trained Consistency Models Perform Better
  25. Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation
    ICLR 2024 · Xuefei Ning