PPaperPicks

Xiaojun Jia

31 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AsFT: Anchoring Safety During LLM Fine-Tuning Within Narrow Safety Basin
  2. EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations
  3. GAMBIT: A Gamified Jailbreak Framework for Multimodal Large Language Models
  4. GeoShield: Safeguarding Geolocation Privacy from Vision-Language Models via Adversarial Perturbations
  5. Know Thy Enemy: Securing LLMs Against Prompt Injection via Diverse Data Synthesis and Instruction-Level Chain-of-Thought Learning
  6. MPAS: Breaking Sequential Constraints of Multi-Agent Communication Topologies via Individual-Epistemic Message Propagation
  7. PhysPatch: A Physically Realizable and Transferable Adversarial Patch Attack for Multimodal Large Language Models-based Autonomous Driving Systems
  8. The Emotional Baby Is Truly Deadly: Does Your Multimodal Large Reasoning Model Have Emotional Flattery Towards Humans?
  9. Towards Identification and Intervention of Safety-Critical Parameters in Large Language Models
  10. 3D Gaussian Splatting Driven Multi-View Robust Physical Adversarial Camouflage Generation
  11. Accelerate 3D Object Detection Models via Zero-Shot Attention Key Pruning
  12. Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment
    NeurIPS 2025 · Xiaojun Jia
  13. AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts
  14. Cannot See the Forest for the Trees: Invoking Heuristics and Biases to Elicit Irrational Choices of LLMs
  15. Crabs: Consuming Resource via Auto-generation for LLM-DoS Attack under Black-box Settings
  16. DAMA: Data- and Model-aware Alignment of Multi-modal LLMs
  17. Efficient Universal Goal Hijacking with Semantics-guided Prompt Organization
  18. Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models
  19. Improved Techniques for Optimization-Based Jailbreaking on Large Language Models
    ICLR 2025 · Xiaojun Jia
  20. LLM Jailbreak Detection for (Almost) Free!
  21. One Shot Dominance: Knowledge Poisoning Attack on Retrieval-Augmented Generation Systems
  22. PATFinger: Prompt-Adapted Transferable Fingerprinting against Unauthorized Multimodal Dataset Usage
  23. PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization
  24. Perception-Guided Jailbreak Against Text-to-Image Models
  25. SeCon-RAG: A Two-Stage Semantic Filtering and Conflict-Free Framework for Trustworthy RAG
  26. The Eye of Sherlock Holmes: Uncovering User Private Attribute Profiling via Vision-Language Model Agentic Framework
  27. Boosting Transferability in Vision-Language Attacks via Diversification Along the Intersection Region of Adversarial Trajectory
  28. Does Few-Shot Learning Suffer from Backdoor Attacks?
  29. Hide in Thicket: Generating Imperceptible and Rational Adversarial Perturbations on 3D Point Clouds
  30. Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
  31. Poisoned Forgery Face: Towards Backdoor Attacks on Face Forgery Detection