PPaperPicks

Haoran Li

Peking University, School of EECS, Beijing, China

27 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Activation-Guided Local Editing for Jailbreaking Attacks
  2. ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance
    ACL 2026 · Haoran Li
  3. GrandGuard: Taxonomy, Benchmark, and Safeguards for Elderly-Chatbot Interaction Safety
  4. Into the Gray Zone: Domain Contexts Can Blur LLM Safety Boundaries
  5. Jailbreaking Large Language Models with Morality Attacks
  6. OmniCompliance-100K: A Multi-Domain, Rule-Grounded, Real-World Safety Compliance Dataset
  7. Robustness via Referencing: Defending against Prompt Injection Attacks by Referencing the Executed Instruction
  8. SciCustom: A Framework for Custom Evaluation of Scientific Capabilities in Large Language Models
  9. Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods
  10. Can Indirect Prompt Injection Attacks Be Detected and Removed?
  11. Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning
  12. Defense Against Prompt Injection Attack by Leveraging Attack Techniques
  13. InteGround: On the Evaluation of Verification and Retrieval Planning in Integrative Grounding
  14. MCIP: Protecting MCP Safety via Model Contextual Integrity Protocol
  15. On the Role of Entity and Event Level Conceptualization in Generalizable Reasoning: A Survey of Tasks, Methods, Applications, and Future Directions
  16. PrivaCI-Bench: Evaluating Privacy with Contextual Integrity and Legal Compliance
    ACL 2025 · Haoran Li
  17. Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory
    NAACL 2025 · Haoran Li
  18. Simulate and Eliminate: Revoke Backdoors for Generative Large Language Models
    AAAI 2025 · Haoran Li
  19. TopicAttack: An Indirect Prompt Injection Attack via Topic Transition
  20. Adaptive Differentially Private Structural Entropy Minimization for Unsupervised Social Event Detection
  21. Audience Persona Knowledge-Aligned Prompt Tuning Method for Online Debate
  22. GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory
  23. LLMs Assist NLP Researchers: Critique Paper (Meta-)Reviewing
  24. NegotiationToM: A Benchmark for Stress-testing Machine Theory of Mind on Negotiation Surrounding
  25. PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
    ACL 2024 · Haoran Li
  26. Privacy-Preserved Neural Graph Databases
  27. Table-Filling via Mean Teacher for Cross-domain Aspect Sentiment Triplet Extraction