PPaperPicks

Ruihao Gong

16 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing
  2. Half-S: Halving the Scale for Near-Lossless 4-Bit LLM Training
  3. LLMC+: Benchmarking Vision-Language Model Compression with a plug-and-play Toolkit
  4. AtomNet: Designing Tiny Models from Operators Under Extreme MCU Constraints
  5. DA-KD: Difficulty-Aware Knowledge Distillation for Efficient Large Language Models
  6. HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
  7. Hierachical Balance Packing: Towards Efficient Supervised Fine-tuning for Long-Context LLM
  8. OmniBal: Towards Fast Instruction-Tuning for Vision-Language Models via Omniverse Computation Balance
  9. Pre³: Enabling Deterministic Pushdown Automata for Faster Structured LLM Generation
  10. Compressing Large Language Models by Joint Sparsification and Quantization
  11. Fast and Controllable Post-training Sparsity: Learning Optimal Sparsity Allocation with Global Constraint in Minutes
    AAAI 2024 · Ruihao Gong
  12. LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
    EMNLP 2024 · Ruihao Gong
  13. PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models
  14. QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models
  15. Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection
  16. TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models