PPaperPicks

Wei Liu

Tencent AI Lab, Shenzhen, China

23 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AROMA: Augmented Reasoning Over a Multimodal Architecture for Virtual Cell Genetic Perturbation Modeling
  2. From Style to Story: A Curriculum Learning Approach for Imitative Novel Generation
  3. When Personalization Tricks Detectors: The Feature-Inversion Trap in Machine-Generated Text Detection
  4. Annotation-guided Protein Design with Multi-Level Domain Alignment
  5. Atomas: Hierarchical Adaptive Alignment on Molecule-Text for Unified Molecule Understanding and Generation
  6. DialogGen: Multi-modal Interactive Dialogue System with Multi-turn Text-Image Generation
  7. Follow-Your-Click: Open-domain Regional Image Animation via Motion Prompts
  8. IDOL: Instant Photorealistic 3D Human Creation from a Single Image
  9. Infinite-Canvas: Higher-Resolution Video Outpainting with Extensive Content Generation
  10. Large Language and Protein Assistant for Protein-Protein Interactions Prediction
  11. Local Conditional Controlling for Text-to-Image Diffusion Models
  12. Modeling All Response Surfaces in One for Conditional Search Spaces
  13. MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls
  14. Towards Multiple Character Image Animation Through Enhancing Implicit Decoupling
  15. UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation
  16. $\text{Di}2\text{Pose}$: Discrete Diffusion Model for Occluded 3D Human Pose Estimation
  17. BadCLIP: Trigger-Aware Prompt Learning for Backdoor Attacks on CLIP
  18. EBMDock: Neural Probabilistic Protein-Protein Docking via a Differentiable Energy Model
  19. Enhancing Human Experience in Human-Agent Collaboration: A Human-Centered Modeling Approach Based on Positive Human Gain
  20. Inducing High Energy-Latency of Large Vision-Language Models with Verbose Images
  21. LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment
  22. OMG: Occlusion-Friendly Personalized Multi-concept Generation in Diffusion Models
  23. Prompting Future Driven Diffusion Model for Hand Motion Prediction