PPaperPicks

Yang You

National University of Singapore

38 papers at tracked venues · 34 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. GroupToM-Bench: Benchmarking Group Theory of Mind and Nonlinear Social Emergence in MLLMs
  2. MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
  3. A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
  4. A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
  5. DSP: Dynamic Sequence Parallelism for Multi-Dimensional Transformers
  6. DavIR: Data Selection via Implicit Reward for Large Language Models
  7. Drag-and-Drop LLMs: Zero-Shot Prompt-to-Weights
  8. Dynamic Diffusion Transformer
  9. ElasticMM: Efficient Multimodal LLMs Serving with Elastic Multimodal Parallelism
  10. Emphasizing Discriminative Features for Dataset Distillation in Complex Scenarios
  11. Info-Coevolution: An Efficient Framework for Data Model Coevolution
  12. MERIT: Maximum-normalized Element-wise Ratio for Language Model Large-batch Training
  13. MixEval-X: Any-to-any Evaluations from Real-world Data Mixture
  14. Neural-Driven Image Editing
  15. REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
  16. Real-Time Video Generation with Pyramid Attention Broadcast
  17. Scaling Up Parameter Generation: A Recurrent Diffusion Approach
  18. SeedLoRA: A Fusion Approach to Efficient LLM Fine-Tuning
  19. Sparse MeZO: Less Parameters for Better Performance in Zeroth-Order LLM Fine-Tuning
  20. StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
  21. Unsupervised Learning for Class Distribution Mismatch
  22. AutoChunk: Automated Activation Chunk for Memory-Efficient Deep Learning Inference
  23. Dataset Growth
  24. DiM: Distilling Dataset into Generative Model
  25. DiffAug: Enhance Unsupervised Contrastive Learning with Domain-Knowledge-Free Diffusion-based Data Augmentation
  26. Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
  27. Efficient Dataset Distillation via Minimax Diffusion
  28. Helen: Optimizing CTR Prediction Models with Frequency-wise Hessian Eigenvalue Regularization
  29. HeteGen: Efficient Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
  30. How Does the Textual Information Affect the Retrieval of Multimodal In-Context Learning?
  31. InfoBatch: Lossless Training Speed Up by Unbiased Dynamic Data Pruning
  32. MixEval: Deriving Wisdom of the Crowd from LLM Benchmark Mixtures
  33. Navigating Complexity: Toward Lossless Graph Condensation via Expanding Window Matching
  34. OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models
  35. Rethinking Human Evaluation Protocol for Text-to-Video Models: Enhancing Reliability, Reproducibility, and Practicality
  36. Summarizing Stream Data for Memory-Constrained Online Continual Learning
  37. The Snowflake Hypothesis: Training and Powering GNN with One Node One Receptive Field
  38. Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching