P
PaperPicks
Conferences
Jianfei Chen
Tsinghua University, Beijing, China
22 papers at tracked venues · 22 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID 0000-0002-9279-6098 ↗
Homepage ↗
Venues
ICML
×8
ICLR
×7
NeurIPS
×5
AAAI
×1
ACM MM
×1
Frequent coauthors
Jintao Zhang
DBLP profile ↗
ORCID search ↗
×4
Haocheng Xi
DBLP profile ↗
ORCID search ↗
×3
Kaiwen Zheng
DBLP profile ↗
ORCID search ↗
×2
Ziteng Wang
DBLP profile ↗
ORCID search ↗
×2
Yuezhou Hu
DBLP profile ↗
ORCID search ↗
×2
Yuji Wang
DBLP profile ↗
ORCID search ↗
×1
Chang Gao
DBLP profile ↗
ORCID search ↗
×1
Bingrui Li
DBLP profile ↗
ORCID search ↗
×1
Yuxiang Chen
DBLP profile ↗
ORCID search ↗
×1
Weiyu Huang
DBLP profile ↗
ORCID search ↗
×1
Shuo Yang
DBLP profile ↗
ORCID search ↗
×1
Huayu Chen
DBLP profile ↗
ORCID search ↗
×1
Papers
COAT: Compressing Optimizer states and Activations for Memory-Efficient FP8 Training
ICLR 2025
·
Haocheng Xi
DBLP profile ↗
ORCID search ↗
Diffusion Bridge Implicit Models
ICLR 2025
·
Kaiwen Zheng
DBLP profile ↗
ORCID search ↗
Elucidating the Preconditioning in Consistency Distillation
ICLR 2025
·
Kaiwen Zheng
DBLP profile ↗
ORCID search ↗
FrameBridge: Improving Image-to-Video Generation with Bridge Models
ICML 2025
·
Yuji Wang
DBLP profile ↗
ORCID search ↗
Maximum Redundancy Pruning: A Principle-Driven Layerwise Sparsity Allocation for LLMs
ACM MM 2025
·
Chang Gao
DBLP profile ↗
ORCID search ↗
On the Optimization and Generalization of Two-layer Transformers with Sign Gradient Descent
ICLR 2025
·
Bingrui Li
DBLP profile ↗
ORCID search ↗
Oscillation-Reduced MXFP4 Training for Vision Transformers
ICML 2025
·
Yuxiang Chen
DBLP profile ↗
ORCID search ↗
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
AAAI 2025
·
Weiyu Huang
DBLP profile ↗
ORCID search ↗
ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing
ICLR 2025
·
Ziteng Wang
DBLP profile ↗
ORCID search ↗
SageAttention2: Efficient Attention with Thorough Outlier Smoothing and Per-thread INT4 Quantization
ICML 2025
·
Jintao Zhang
DBLP profile ↗
ORCID search ↗
SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training
NeurIPS 2025
·
Jintao Zhang
DBLP profile ↗
ORCID search ↗
SageAttention: Accurate 8-Bit Attention for Plug-and-play Inference Acceleration
ICLR 2025
·
Jintao Zhang
DBLP profile ↗
ORCID search ↗
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
ICML 2025
·
Jintao Zhang
DBLP profile ↗
ORCID search ↗
Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
ICML 2025
·
Haocheng Xi
DBLP profile ↗
ORCID search ↗
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
NeurIPS 2025
·
Shuo Yang
DBLP profile ↗
ORCID search ↗
Visual Generation Without Guidance
ICML 2025
·
Huayu Chen
DBLP profile ↗
ORCID search ↗
Accelerating Transformer Pre-training with 2: 4 Sparsity
ICML 2024
·
Yuezhou Hu
DBLP profile ↗
ORCID search ↗
C-GAIL: Stabilizing Generative Adversarial Imitation Learning with Control Theory
NeurIPS 2024
·
Tianjiao Luo
DBLP profile ↗
ORCID search ↗
Consistency Diffusion Bridge Models
NeurIPS 2024
·
Guande He
DBLP profile ↗
ORCID search ↗
Efficient Backpropagation with Variance Controlled Adaptive Sampling
ICLR 2024
·
Ziteng Wang
DBLP profile ↗
ORCID search ↗
Jetfire: Efficient and Accurate Transformer Pretraining with INT8 Data Flow and Per-Block Quantization
ICML 2024
·
Haocheng Xi
DBLP profile ↗
ORCID search ↗
S-STE: Continuous Pruning Function for Efficient 2: 4 Sparse Pre-training
NeurIPS 2024
·
Yuezhou Hu
DBLP profile ↗
ORCID search ↗