PPaperPicks

Kurt Keutzer

University of California, Berkeley, USA

44 papers at tracked venues · 35 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ODEt(ODEl): Shortcutting the Time and the Length in Diffusion and Flow Models for Faster Sampling
  2. A Lesson in Splats: Teacher-Guided Diffusion for 3D Gaussian Splats Generation with 2D Supervision
  3. Angles Don't Lie: Unlocking Training‑Efficient RL Through the Model's Own Signals
  4. Bridging Viewpoint Gaps: Geometric Reasoning Boosts Semantic Correspondence
  5. COAT: Compressing Optimizer states and Activations for Memory-Efficient FP8 Training
  6. DeSiRe-GS: 4D Street Gaussians for Static-Dynamic Decomposition and Surface Reconstruction for Urban Driving Scenes
  7. Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
  8. DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving
  9. K-Sort Arena: Efficient and Reliable Benchmarking for Generative Models via K-wise Human Preferences
  10. Looking Backward: Streaming Video-to-Video Translation with Feature Banks
  11. Multipole Attention for Efficient Long Context Reasoning
  12. Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks
  13. QuantSpec: Self-Speculative Decoding with Hierarchical Quantized KV Cache
  14. Radial Attention: 𝒪(n log n) Sparse Attention with Energy Decay for Long Video Generation
  15. S*: Test Time Scaling for Code Generation
  16. STORM: Token-Efficient Long Video Understanding for Multimodal LLMs
  17. Segment Any Motion in Videos
  18. Sparse Video-Gen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
  19. Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
  20. SparseLoRA: Accelerating LLM Fine-Tuning with Contextual Sparsity
  21. SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference
  22. Squeezed Attention: Accelerating Long Context Length LLM Inference
    ACL 2025 ·
    Coleman Richard Charles Hooper
  23. StreamDiffusion: A Pipeline-Level Solution for Real-Time Interactive Generation
  24. UniDrive: Towards Universal Driving Perception Across Camera Configurations
  25. Why Do Multi-Agent LLM Systems Fail?
  26. Aligning Large Multimodal Models with Factually Augmented RLHF
  27. An LLM Compiler for Parallel Function Calling
  28. Efficient Deweahter Mixture-of-Experts with Uncertainty-Aware Feature-Wise Linear Modulation
  29. Immiscible Diffusion: Accelerating Diffusion Training with Noise Assignment
  30. KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization
  31. LLM2LLM: Boosting LLMs with Novel Iterative Data Enhancement
  32. LLoCO: Learning Long Contexts Offline
  33. MAgIC: Investigation of Large Language Model Powered Multi-Agent in Cognition, Adaptability, Rationality and Collaboration
  34. Magic-Me: Identity-Specific Video Customized Diffusion
  35. Mixture-of-Experts Meets Instruction Tuning: A Winning Combination for Large Language Models
  36. One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
  37. PromptCoT: Align Prompt Distribution via Adapted Chain-of-Thought
  38. SLoRA: Scalable Serving of Thousands of LoRA Adapters
  39. Sharpness-diversity tradeoff: improving flat ensembles with SharpBalance
  40. Sparse Refinement for Efficient High-Resolution Semantic Segmentation
  41. Split-Ensemble: Efficient OOD-aware Ensemble via Task and Model Splitting
  42. SqueezeLLM: Dense-and-Sparse Quantization
  43. TinyAgent: Function Calling at the Edge
  44. VeCAF: Vision-language Collaborative Active Finetuning with Training Objective Awareness