PPaperPicks

Yabiao Wang

31 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing
  2. Disco-RAG: Discourse-Aware Retrieval-Augmented Generation
  3. LLM-Oriented Token-Adaptive Knowledge Distillation
  4. SwiftVideo: A Unified Framework for Few-Step Video Generation Through Trajectory-Distribution Alignment
  5. A Comprehensive Library for Benchmarking Multi-Class Visual Anomaly Detection
  6. Dual-Interrelated Diffusion Model for Few-Shot Anomaly Image Generation
  7. Identity-Preserving Text-to-Video Generation Guided by Simple yet Effective Spatial-Temporal Decoupled Representations
  8. Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
  9. MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
  10. OSV: One Step is Enough for High-Quality Image to Video Generation
  11. PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
  12. SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
  13. TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation
    CVPR 2025 · Yabiao Wang
  14. Towards Universal Dataset Distillation via Task-Driven Diffusion
  15. UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
  16. Unicombine: Unified Multi-Conditional Combination with Diffusion Transformer
  17. WaveAR: Wavelet-Aware Continuous Autoregressive Diffusion for Accurate Human Motion Prediction
  18. A Diffusion-Based Framework for Multi-Class Anomaly Detection
  19. AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
  20. COMD: Training-free Video Motion Transfer With Camera-Object Motion Disentanglement
  21. Density Matters: Improved Core-Set for Active Domain Adaptive Segmentation
  22. Fetch and Forge: Efficient Dataset Condensation for Object Detection
  23. FreeMotion: A Unified Framework for Number-Free Text-to-Motion Synthesis
  24. LLaVA-VSD: Large Language-and-Vision Assistant for Visual Spatial Description
  25. Learning Unified Reference Representation for Unsupervised Multi-class Anomaly Detection
  26. MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
  27. MambaGesture: Enhancing Co-Speech Gesture Generation with Mamba and Disentangled Multi-Modality Fusion
  28. Rethinking Reverse Distillation for Multi-Modal Anomaly Detection
  29. Self-Supervised Likelihood Estimation with Energy Guidance for Anomaly Segmentation in Urban Scenes
  30. Self-supervised Feature Adaptation for 3D Industrial Anomaly Detection
  31. UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation