PPaperPicks

Chun Yuan

Tsinghua University, Shenzhen, China

55 papers at tracked venues · 49 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
  2. Efficient Transformer Parameter Reuse via Zero-Token Mechanism
  3. M3Time: LLM-Enhanced Multi-Modal, Multi-Scale, and Multi-Frequency Multivariate Time Series Forecasting
  4. PRIME: A Process-Outcome Alignment Benchmark for Verifiable Reasoning in Mathematics and Engineering
  5. Prune&Comp: Free Lunch for Layer-Pruned LLMs via Iterative Pruning with Magnitude Compensation
  6. A Simple Linear Patch Revives Layer-Pruned Large Language Models
  7. Aligning Composed Query with Image via Discriminative Perception from Negative Correspondences
  8. ChartMoE: Mixture of Diversely Aligned Expert Connector for Chart Understanding
  9. ChartPoint: Guiding MLLMs with Grounding Reflection for Chart Reasoning
  10. ComRoPE: Scalable and Robust Rotary Position Embedding Parameterized by Trainable Commuting Angle Matrices
  11. Enhancing Logits Distillation with Plug&Play Kendall's τ Ranking Loss
  12. FlatQuant: Flatness Matters for LLM Quantization
  13. IMDPrompter: Adapting SAM to Image Manipulation Detection by Cross-View Automated Prompt Learning
  14. IteRPrimE: Zero-shot Referring Image Segmentation with Iterative Grad-CAM Refinement and Primary Word Emphasis
  15. LoRA Recycle: Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
  16. Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
  17. NaDRO: Leveraging Dual-Reward Strategies for LLMs Training on Noisy Data
  18. Open-Vocabulary Customization from CLIP via Data-Free Knowledge Distillation
  19. Perceive, Understand and Restore: Real-World Image Super-Resolution with Autoregressive Multimodal Generative Models
  20. Preference Optimization for Combinatorial Optimization Problems
  21. Rethinking Pseudo-Label Guided Learning for Weakly Supervised Temporal Action Localization from the Perspective of Noise Correction
  22. SCOUT: Teaching Pre-trained Language Models to Enhance Reasoning via Flow Chain-of-Thought
  23. Safe-Sora: Safe Text-to-Video Generation via Graphical Watermarking
  24. SparseFlex: High-Resolution and Arbitrary-Topology 3D Shape Modeling
  25. Text-Guided Visual Prompt DINO for Generic Segmentation
  26. Towards Implicit Aggregation: Robust Image Representation for Place Recognition in the Transformer Era
  27. Towards Robust Uncertainty Calibration for Composed Image Retrieval
  28. UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis
  29. Unsupervised Domain Adaptive Visual Question Answering in the Era of Multi-Modal Large Language Models
  30. Vpr-Cloak: a First Look at Privacy Cloak Against Visual Place Recognition
  31. Weakly Supervised Temporal Action Localization via Dual-Prior Collaborative Learning Guided by Multimodal Large Language Models
  32. Whoever Started the interference Should End It: Guiding Data-Free Model Merging via Task Vectors
  33. A Task Is Worth One Word: Learning with Task Prompts for High-Quality Versatile Image Inpainting
  34. Blind Face Restoration under Extreme Conditions: Leveraging 3D-2D Prior Fusion for Superior Structural and Texture Recovery
  35. Boosting Pose Estimators via Cross-Representation Distillation
  36. Convolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything Model
  37. CricaVPR: Cross-Image Correlation-Aware Representation Learning for Visual Place Recognition
  38. CrossGET: Cross-Guided Ensemble of Tokens for Accelerating Vision-Language Transformers
  39. CustomNet: Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models
  40. DFD: Distilling the Feature Disparity Differently for Detectors
  41. Deep Homography Estimation for Visual Place Recognition
  42. Distilling Semantic Priors from SAM to Efficient Image Restoration Models
  43. DreamDiffusion: High-Quality EEG-to-Image Generation with Temporal Masked Signal Modeling and CLIP Alignment
  44. Efficient Conditional Diffusion Model with Probability Flow Sampling for Image Super-resolution
  45. Free: Faster and Better Data-Free Meta-Learning
  46. GVGEN: Text-to-3D Generation with Volumetric Representation
  47. IntactKV: Improving Large Language Model Quantization by Keeping Pivot Tokens Intact
  48. Mean Teacher DETR with Masked Feature Alignment: A Robust Domain Adaptive Detection Transformer Framework
  49. MirrorGaussian: Reflecting 3D Gaussians for Reconstructing Mirror Reflections
  50. Semantic Distillation from Neighborhood for Composed Image Retrieval
  51. Sparse Model Inversion: Efficient Inversion of Vision Transformers for Data-Free Applications
  52. SuperVLAD: Compact and Robust Image Descriptors for Visual Place Recognition
  53. Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
  54. Towards Seamless Adaptation of Pre-trained Models for Visual Place Recognition
  55. ViTKD: Feature-based Knowledge Distillation for Vision Transformers