PPaperPicks

Wenjie Wang

6 papers at tracked venues · 3 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. Adversary-Aware DPO: Enhancing Safety Alignment in Vision Language Models via Adversarial Training
  2. Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
  3. Don't Say No: Jailbreaking LLM by Suppressing Refusal
  4. Cross-modality Information Check for Detecting Jailbreaking in Multimodal Large Language Models
  5. IGAMT: Privacy-Preserving Electronic Health Record Synthesization with Heterogeneity and Irregularity
    AAAI 2024 · Wenjie Wang
  6. LinkPrompt: Natural and Universal Adversarial Attacks on Prompt-based Language Models