P
PaperPicks
Conferences
Ruihao Gong
16 papers at tracked venues · 15 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×4
ICML
×4
ACL
×3
ACM MM
×1
CVPR
×1
EMNLP
×1
ICLR
×1
NeurIPS
×1
Frequent coauthors
Yushi Huang
DBLP profile ↗
ORCID search ↗
×2
Yongqiang Yao
DBLP profile ↗
ORCID search ↗
×2
Lingkun Long
DBLP profile ↗
ORCID search ↗
×1
Jinyang Du
DBLP profile ↗
ORCID search ↗
×1
Chengtao Lv
DBLP profile ↗
ORCID search ↗
×1
Zhiwei Dong
DBLP profile ↗
ORCID search ↗
×1
Changyi He
DBLP profile ↗
ORCID search ↗
×1
Junyi Chen
DBLP profile ↗
ORCID search ↗
×1
Jinyang Guo
DBLP profile ↗
ORCID search ↗
×1
Zining Wang
DBLP profile ↗
ORCID search ↗
×1
Jing Liu
DBLP profile ↗
ORCID search ↗
×1
Yunqian Fan
DBLP profile ↗
ORCID search ↗
×1
Papers
Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing
ACL 2026
·
Lingkun Long
DBLP profile ↗
ORCID search ↗
Half-S: Halving the Scale for Near-Lossless 4-Bit LLM Training
ACL 2026
·
Jinyang Du
DBLP profile ↗
ORCID search ↗
LLMC+: Benchmarking Vision-Language Model Compression with a plug-and-play Toolkit
AAAI 2026
·
Chengtao Lv
DBLP profile ↗
ORCID search ↗
AtomNet: Designing Tiny Models from Operators Under Extreme MCU Constraints
AAAI 2025
·
Zhiwei Dong
DBLP profile ↗
ORCID search ↗
DA-KD: Difficulty-Aware Knowledge Distillation for Efficient Large Language Models
ICML 2025
·
Changyi He
DBLP profile ↗
ORCID search ↗
HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
ICML 2025
·
Yushi Huang
DBLP profile ↗
ORCID search ↗
Hierachical Balance Packing: Towards Efficient Supervised Fine-tuning for Long-Context LLM
NeurIPS 2025
·
Yongqiang Yao
DBLP profile ↗
ORCID search ↗
OmniBal: Towards Fast Instruction-Tuning for Vision-Language Models via Omniverse Computation Balance
ICML 2025
·
Yongqiang Yao
DBLP profile ↗
ORCID search ↗
Pre³: Enabling Deterministic Pushdown Automata for Faster Structured LLM Generation
ACL 2025
·
Junyi Chen
DBLP profile ↗
ORCID search ↗
Compressing Large Language Models by Joint Sparsification and Quantization
ICML 2024
·
Jinyang Guo
DBLP profile ↗
ORCID search ↗
Fast and Controllable Post-training Sparsity: Learning Optimal Sparsity Allocation with Global Constraint in Minutes
AAAI 2024
·
Ruihao Gong
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
EMNLP 2024
·
Ruihao Gong
PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models
ACM MM 2024
·
Zining Wang
DBLP profile ↗
ORCID search ↗
QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models
ICLR 2024
·
Jing Liu
DBLP profile ↗
ORCID search ↗
Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection
AAAI 2024
·
Yunqian Fan
DBLP profile ↗
ORCID search ↗
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
CVPR 2024
·
Yushi Huang
DBLP profile ↗
ORCID search ↗