PPaperPicks

Jianfei Chen

Tsinghua University, Beijing, China

22 papers at tracked venues · 22 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. COAT: Compressing Optimizer states and Activations for Memory-Efficient FP8 Training
  2. Diffusion Bridge Implicit Models
  3. Elucidating the Preconditioning in Consistency Distillation
  4. FrameBridge: Improving Image-to-Video Generation with Bridge Models
  5. Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs
  6. On the Optimization and Generalization of Two-layer Transformers with Sign Gradient Descent
  7. Oscillation-Reduced MXFP4 Training for Vision Transformers
  8. Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
  9. ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing
  10. SageAttention2: Efficient Attention with Thorough Outlier Smoothing and Per-thread INT4 Quantization
  11. SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training
  12. SageAttention: Accurate 8-Bit Attention for Plug-and-play Inference Acceleration
  13. SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
  14. Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
  15. Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
  16. Visual Generation Without Guidance
  17. Accelerating Transformer Pre-training with 2: 4 Sparsity
  18. C-GAIL: Stabilizing Generative Adversarial Imitation Learning with Control Theory
  19. Consistency Diffusion Bridge Models
  20. Efficient Backpropagation with Variance Controlled Adaptive Sampling
  21. Jetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization
  22. S-STE: Continuous Pruning Function for Efficient 2: 4 Sparse Pre-training