PPaperPicks

Xinchao Wang

89 papers at tracked venues · 76 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Exploiting Blurry Representations for Event-guided Video Super-Resolution
  2. FreLay: Frequency-aware Energy Function for Training-free Layout-to-Image Generation
  3. Minute-Long Videos with Dual Parallelisms
  4. Taming the Phantom: Token-Asymmetric Filtering for Hallucination Mitigation in Large Vision-Language Models
  5. 1000+ FPS 4D Gaussian Splatting for Dynamic Scene Rendering
  6. Asymmetric Dual-Lens Video Deblurring
  7. Auto-Controlled Image Perception in MLLMs via Visual Perception Tokens
  8. C4D: 4D Made from 3D Through Dual Correspondences
  9. CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up
  10. CoSER: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
  11. CoT-Valve: Length-Compressible Chain-of-Thought Tuning
  12. Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
  13. Control and Realism: Best of Both Worlds in Layout-to-Image without Training
  14. Diffusion Model is Effectively Its Own Teacher
  15. ERF: A Benchmark Dataset for Robust Semantic Segmentation Under Extreme Rainfall Conditions
  16. Efficient Gaussian Splatting for Monocular Dynamic Scene Rendering via Sparse Time-Variant Attribute Modeling
  17. Event-based Video Super-Resolution via State Space Models
  18. Few-shot Implicit Function Generation via Equivariance
  19. GFlow: Recovering 4D World from Monocular Video
  20. Generative Sparse-View Gaussian Splatting
  21. GraphBridge: Towards Arbitrary Transfer Learning in GNNs
  22. HG-Adapter: Improving Pre-Trained Heterogeneous Graph Neural Networks with Dual Adapters
  23. Hash3D: Training-free Acceleration for 3D Generation
  24. Heavy Labels Out! Dataset Distillation with Label Space Lightening
  25. IFAdapter: Instance Feature Control for Grounded Text-to-Image Generation
  26. Image Editing As Programs with Diffusion Models
  27. Kolmogorov-Arnold Transformer
  28. Machine Unlearning in 3D Generation: A Perspective-Coherent Acceleration Framework
  29. MambaOut: Do We Really Need Mamba for Vision?
  30. Neural Phylogeny: Fine-Tuning Relationship Detection among Neural Networks
  31. OminiControl: Minimal and Universal Control for Diffusion Transformer
  32. Open-World Authorship Attribution
  33. POSTA: A Go-to Framework for Customized Artistic Poster Generation
  34. Point Cloud Dataset Distillation
  35. PointLoRA: Low-Rank Adaptation with Token Selection for Point Cloud Learning
  36. Poison-splat: Computation Cost Attack on 3D Gaussian Splatting
  37. Rogsplat: Robust Gaussian Splatting Via Generative Priors
  38. Test3R: Learning to Reconstruct 3D at Test Time
  39. Thinkless: LLM Learns When to Think
  40. Through the Dual-Prism: A Spectral Perspective on Graph Data Augmentation for Graph Classifications
  41. TinyFusion: Diffusion Transformers Learned Shallow
  42. Towards Performance Consistency in Multi-Level Model Collaboration
  43. TreeSplat: Mergeable Tree for Deformable Gaussian Splatting
  44. Ultra-Resolution Adaptation with Ease
  45. UniversalBooth: Model-Agnostic Personalized Text-To-Image Generation
  46. VeriThinker: Learning to Verify Makes Reasoning Model Efficient
  47. Vid-SME: Membership Inference Attacks against Large Video Understanding Models
  48. dKV-Cache: The Cache for Diffusion Language Models
  49. Adapting Visual-Language Models for Generalizable Anomaly Detection in Medical Images
  50. AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
  51. Attention Prompting on Image for Large Vision-Language Models
  52. Beyond Sole Strength: Customized Ensembles for Generalized Vision-Language Models
  53. DeepCache: Accelerating Diffusion Models for Free
  54. Distilled Datamodel with Reverse Gradient Matching
  55. Domain-Adaptive 2D Human Pose Estimation via Dual Teachers in Extremely Low-Light Conditions
  56. DreamDrone: Text-to-Image Diffusion Models Are Zero-Shot Perpetual View Generators
  57. Dual-Path Adversarial Lifting for Domain Shift Correction in Online Test-Time Adaptation
  58. Encapsulating Knowledge in One Prompt
  59. FlashSplat: 2D to 3D Gaussian Splatting Segmentation Solved Optimally
  60. Implicit Curriculum in Procgen Made Explicit
  61. InceptionNeXt: When Inception Meets ConvNeXt
  62. Isomorphic Pruning for Vision Models
  63. Language Model as Visual Explainer
  64. Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
  65. LiteFocus: Accelerated Diffusion Inference for Long Audio Synthesis
  66. MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities
  67. MVGamba: Unify 3D Content Generation as State Space Sequence Modeling
  68. MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models
  69. MetaISP: Efficient RAW-to-sRGB Mappings with Merely 1M Parameters
  70. MindBridge: A Cross-Subject Brain Decoding Framework
  71. Mutual-Modality Adversarial Attack with Semantic Perturbation
  72. Neural Lineage
  73. Neural Metamorphosis
  74. One-shot Federated Learning via Synthetic Distiller-Distillate Communication
  75. P-BiC: Ultra-High-Definition Image Moiré Patterns Removal via Patch Bilateral Compensation
  76. Parameter-Efficient and Memory-Efficient Tuning for Vision Transformer: A Disentangled Approach
  77. Pseudo-Calibration: Improving Predictive Uncertainty Estimation in Unsupervised Domain Adaptation
  78. Receptive Fields As Experts in Convolutional Neural Architectures
  79. Relation Rectification in Diffusion Model
  80. Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
  81. Revisiting Self-Supervised Heterogeneous Graph Learning from Spectral Clustering Perspective
  82. Self-Supervised Heterogeneous Graph Learning: a Homophily and Heterogeneity View
  83. SlimSAM: 0.1% Data Makes Segment Anything Slim
  84. StyDeSty: Min-Max Stylization and Destylization for Single Domain Generalization
  85. Teddy: Efficient Large-Scale Dataset Distillation via Taylor-Approximated Matching
  86. Ungeneralizable Examples
  87. Unraveling Motion Uncertainty for Local Motion Deblurring
  88. Unsegment Anything by Simulating Deformation
  89. Vista3D: Unravel the 3D Darkside of a Single Image