PPaperPicks

Kai Wang

National University of Singapore, School of Computing, Singapore

40 papers at tracked venues · 36 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
  2. A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
    CVPR 2025 · Kai Wang
  3. A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
  4. Distilling Long-tailed Datasets
  5. Drag-and-Drop LLMs: Zero-Shot Prompt-to-Weights
  6. Drawing Informative Gradients from Sources: A One-stage Transfer Learning Framework for Cross-city Spatiotemporal Forecasting
  7. Dynamic Diffusion Transformer
  8. EA-Vit: Efficient Adaptation for Elastic Vision Transformer
  9. Emphasizing Discriminative Features for Dataset Distillation in Complex Scenarios
    CVPR 2025 · Kai Wang
  10. Info-Coevolution: An Efficient Framework for Data Model Coevolution
  11. MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
  12. Neural-Driven Image Editing
  13. ORAL: Prompting Your Large-Scale LoRAs via Conditional Recurrent Diffusion
  14. Pruning-Robust Mamba with Asymmetric Multi-Scale Scanning Paths
  15. REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
  16. Real-Time Video Generation with Pyramid Attention Broadcast
  17. Scaling Up Parameter Generation: A Recurrent Diffusion Approach
    NeurIPS 2025 · Kai Wang
  18. StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
  19. Time-Frequency Disentanglement Boosted Pre-Training: A Universal Spatio-Temporal Modeling Framework
  20. Unsupervised Learning for Class Distribution Mismatch
  21. X-Field: A Physically Informed Representation for 3D X-ray Reconstruction
  22. ATOM: Attention Mixer for Efficient Dataset Distillation
  23. Aligning Large Language Models with Representation Editing: A Control Perspective
  24. Can We Evaluate Domain Adaptation Models Without Target-Domain Labels?
  25. Causal Deciphering and Inpainting in Spatio-Temporal Dynamics via Diffusion Model
  26. Dataset Growth
  27. DiM: Distilling Dataset into Generative Model
    ECCV 2024 · Kai Wang
  28. DiffAug: Enhance Unsupervised Contrastive Learning with Domain-Knowledge-Free Diffusion-based Data Augmentation
  29. Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
  30. Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
  31. GDeR: Safeguarding Efficiency, Balancing, and Robustness via Prototypical Graph Pruning
  32. InfoBatch: Lossless Training Speed Up by Unbiased Dynamic Data Pruning
  33. MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
  34. Navigating Complexity: Toward Lossless Graph Condensation via Expanding Window Matching
  35. NuwaDynamics: Discovering and Updating in Causal Spatio-Temporal Modeling
  36. Rethinking Human Evaluation Protocol for Text-to-Video Models: Enhancing Reliability, Reproducibility, and Practicality
  37. Summarizing Stream Data for Memory-Constrained Online Continual Learning
  38. The Snowflake Hypothesis: Training and Powering GNN with One Node One Receptive Field
  39. Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching
  40. Two Heads Are Better Than One: Boosting Graph Sparse Training via Semantic and Topological Awareness