P
PaperPicks
Conferences
Dan Alistarh
IST Austria, Klosterneuburg, Austria
33 papers at tracked venues · 25 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-3650-940X ↗
Google Scholar ↗
Homepage ↗
Venues
NeurIPS
×9
ICML
×8
ICLR
×6
AISTATS
×2
EMNLP
×2
MLSys
×2
AAAI
×1
ACL
×1
EACL
×1
NAACL
×1
Frequent coauthors
Saleh Ashkboos
DBLP profile ↗
ORCID search ↗
×3
Eldar Kurtic
DBLP profile ↗
ORCID search ↗
×2
Mahdi Nikdan
DBLP profile ↗
ORCID search ↗
×2
Vladimir Malinovskii
DBLP profile ↗
ORCID search ↗
×2
Andrei Panferov
DBLP profile ↗
ORCID search ↗
×2
Ionut-Vlad Modoranu
DBLP profile ↗
ORCID search ↗
×2
Elias Frantar
DBLP profile ↗
ORCID search ↗
×2
Sergey Pankratov
DBLP profile ↗
ORCID search ↗
×1
Alina Shutova
DBLP profile ↗
ORCID search ↗
×1
Oliver Sieberling
DBLP profile ↗
ORCID search ↗
×1
Gleb Rodionov
DBLP profile ↗
ORCID search ↗
×1
Shayan Talaei
DBLP profile ↗
ORCID search ↗
×1
Papers
Speculative Decoding Speed-of-Light: Optimal Lower Bounds via Branching Random Walks
EACL 2026
·
Sergey Pankratov
DBLP profile ↗
ORCID search ↗
"Give Me BF16 or Give Me Death"? Accuracy-Performance Trade-Offs in LLM Quantization
ACL 2025
·
Eldar Kurtic
DBLP profile ↗
ORCID search ↗
Cache Me If You Must: Adaptive Key-Value Quantization for Large Language Models
ICML 2025
·
Alina Shutova
DBLP profile ↗
ORCID search ↗
Efficient Data Selection at Scale via Influence Distillation
NeurIPS 2025
·
Mahdi Nikdan
DBLP profile ↗
ORCID search ↗
EvoPress: Accurate Dynamic Model Compression via Evolutionary Search
ICML 2025
·
Oliver Sieberling
DBLP profile ↗
ORCID search ↗
HALO: Hadamard-Assisted Lower-Precision Optimization for LLMs
NeurIPS 2025
·
Saleh Ashkboos
DBLP profile ↗
ORCID search ↗
HIGGS: Pushing the Limits of Large Language Model Quantization via the Linearity Theorem
NAACL 2025
·
Vladimir Malinovskii
DBLP profile ↗
ORCID search ↗
Hogwild! Inference: Parallel LLM Generation via Concurrent Attention
NeurIPS 2025
·
Gleb Rodionov
DBLP profile ↗
ORCID search ↗
Hybrid Decentralized Optimization: Leveraging Both First- and Zeroth-Order Optimizers for Faster Convergence
AAAI 2025
·
Shayan Talaei
DBLP profile ↗
ORCID search ↗
LDAdam: Adaptive Optimization from Low-Dimensional Gradient Statistics
ICLR 2025
·
Thomas Robert
DBLP profile ↗
ORCID search ↗
Layer-wise Quantization for Quantized Optimistic Dual Averaging
ICML 2025
·
Anh Duc Nguyen
DBLP profile ↗
ORCID search ↗
QuEST: Stable Training of LLMs with 1-Bit Weights and Activations
ICML 2025
·
Andrei Panferov
DBLP profile ↗
ORCID search ↗
Quartet: Native FP4 Training Can Be Optimal for Large Language Models
NeurIPS 2025
·
Roberto L. Castro
DBLP profile ↗
ORCID search ↗
Scalable Mechanistic Neural Networks
ICLR 2025
·
Jiale Chen
DBLP profile ↗
ORCID search ↗
The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws
ICLR 2025
·
Tian Jin
DBLP profile ↗
ORCID search ↗
Unified Scaling Laws for Compressed Representations
NeurIPS 2025
·
Andrei Panferov
DBLP profile ↗
ORCID search ↗
Wasserstein Distances, Neuronal Entanglement, and Sparsity
ICLR 2025
·
Shashata Sawmya
DBLP profile ↗
ORCID search ↗
AsGrad: A Sharp Unified Analysis of Asynchronous-SGD Algorithms
AISTATS 2024
·
Rustem Islamov
DBLP profile ↗
ORCID search ↗
Communication-Efficient Federated Learning With Data and Client Heterogeneity
AISTATS 2024
·
Hossein Zakerinia
DBLP profile ↗
ORCID search ↗
Error Feedback Can Accurately Compress Preconditioners
ICML 2024
·
Ionut-Vlad Modoranu
DBLP profile ↗
ORCID search ↗
Extreme Compression of Large Language Models via Additive Quantization
ICML 2024
·
Vage Egiazarian
DBLP profile ↗
ORCID search ↗
L-GreCo: Layerwise-adaptive Gradient Compression For Efficient Data-parallel Deep Learning
MLSys 2024
·
Ilia Markov
DBLP profile ↗
ORCID search ↗
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
EMNLP 2024
·
Eldar Kurtic
DBLP profile ↗
ORCID search ↗
MicroAdam: Accurate Adaptive Optimization with Low Space Overhead and Provable Convergence
NeurIPS 2024
·
Ionut-Vlad Modoranu
DBLP profile ↗
ORCID search ↗
PV-Tuning: Beyond Straight-Through Estimation for Extreme LLM Compression
NeurIPS 2024
·
Vladimir Malinovskii
DBLP profile ↗
ORCID search ↗
QMoE: Sub-1-Bit Compression of Trillion Parameter Models
MLSys 2024
·
Elias Frantar
DBLP profile ↗
ORCID search ↗
QUIK: Towards End-to-end 4-Bit Inference on Generative Large Language Models
EMNLP 2024
·
Saleh Ashkboos
DBLP profile ↗
ORCID search ↗
QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs
NeurIPS 2024
·
Saleh Ashkboos
DBLP profile ↗
ORCID search ↗
RoSA: Accurate Parameter-Efficient Fine-Tuning via Robust Adaptation
ICML 2024
·
Mahdi Nikdan
DBLP profile ↗
ORCID search ↗
SPADE: Sparsity-Guided Debugging for Deep Neural Networks
ICML 2024
·
Arshia Soltani Moakhar
DBLP profile ↗
ORCID search ↗
Scaling Laws for Sparsely-Connected Foundation Models
ICLR 2024
·
Elias Frantar
DBLP profile ↗
ORCID search ↗
SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression
ICLR 2024
·
Tim Dettmers
DBLP profile ↗
ORCID search ↗
The Iterative Optimal Brain Surgeon: Faster Sparse Recovery by Leveraging Second-Order Information
NeurIPS 2024
·
Diyuan Wu
DBLP profile ↗
ORCID search ↗