PPaperPicks

Wenyu Liu

Huazhong University of Science & Technology, Deptartment of Electronics & Information Engineering, Wuhan, China

26 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Gait Recognition via Collaborating Discriminative and Generative Diffusion Models
  2. LENS: Learning to Segment Anything with Unified Reinforced Reasoning
  3. MolSight: Optical Chemical Structure Recognition with SMILES Pretraining, Multi-Granularity Learning and Reinforcement Learning
  4. Turbo-VAED: Fast and Stable Transfer of Video-VAEs to Mobile Devices
  5. ControlAR: Controllable Image Generation with Autoregressive Models
  6. Dynamic 2D Gaussians: Geometrically Accurate Radiance Fields for Dynamic Objects
  7. GaraMoSt: Parallel Multi-Granularity Motion and Structural Modeling for Efficient Multi-Frame Interpolation in DSA Images
  8. GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding
  9. Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
  10. GroundingSuite: Measuring Complex Multi-Granular Pixel Grounding
  11. MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling
  12. Mask-Adapter: The Devil is in the Masks for Open-Vocabulary Segmentation
  13. RAD: Training an End-to-End Driving Policy via Large-Scale 3DGS-based Reinforcement Learning
  14. 4D Gaussian Splatting for Real-Time Dynamic Scene Rendering
  15. Causality-Inspired Discriminative Feature Learning in Triple Domains for Gait Recognition
  16. FasterDiT: Towards Faster Diffusion Transformers Training without Architecture Modification
  17. GaussianDreamer: Fast Generation from Text to 3D Gaussians by Bridging 2D and 3D Diffusion Models
  18. Lane Graph as Path: Continuity-Preserving Path-Wise Modeling for Online Lane Graph Construction
  19. MoSt-DSA: Modeling Motion and Structural Interactions for Direct Multi-Frame Interpolation in DSA Images
  20. MobileInst: Video Instance Segmentation on the Mobile
  21. Occupancy as Set of Points
  22. Symphonize 3D Semantic Scene Completion with Contextual Instance Queries
  23. Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model
  24. Visual Text Generation in the Wild
  25. WeakSAM: Segment Anything Meets Weakly-supervised Instance-level Recognition
  26. YOLO-World: Real-Time Open-Vocabulary Object Detection