PPaperPicks

Yige Li

13 papers at tracked venues · 9 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BackdoorAgent: A Unified Framework for Backdoor Attacks on LLM-based Agents
  2. Unleashing the Unseen: Harnessing Benign Datasets for Jailbreaking Large Language Models
  3. Anyattack: Towards Large-scale Self-supervised Adversarial Attacks on Vision-language Models
  4. Backdoor Token Unlearning: Exposing and Defending Backdoors in Pretrained Language Models
  5. BackdoorLLM: A Comprehensive Benchmark for Backdoor Attacks and Defenses on Large Language Models
    NeurIPS 2025 · Yige Li
  6. BlueSuffix: Reinforced Blue Teaming for Vision-Language Models Against Jailbreak Attacks
  7. CROW: Eliminating Backdoors from Large Language Models via Internal Consistency Regularization
  8. Detecting Backdoor Samples in Contrastive Language Image Pretraining
  9. Do Influence Functions Work on Large Language Models?
  10. Memory Injection Attacks on LLM Agents via Query-Only Interaction
  11. X-Transfer Attacks: Towards Super Transferable Adversarial Attacks on CLIP
  12. Zero-Shot Defense Against Toxic Images via Inherent Multimodal Alignment in LVLMs
  13. Defending Large Language Models Against Jailbreak Attacks via Layer-specific Editing