PPaperPicks

Zhuosheng Zhang

Shanghai Jiao Tong University, Shanghai, China

43 papers at tracked venues · 34 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Agent-Dice: Disentangling Knowledge Updates via Geometric Consensus for Agent Continual Learning
  2. An LLM-based Quantitative Framework for Evaluating High-Stealthy Backdoor Risks in OSS Supply Chains
  3. ColorBench: Benchmarking Mobile Agents with Graph-Structured Framework for Complex Long-Horizon Tasks
  4. ColorBrowserAgent: Complex Long-Horizon Browser Agent with Adaptive Knowledge Evolution
  5. EVA: Evolving Semantic Adversaries for Red-Teaming GUI Agents Against Environmental Injection Attacks
  6. GEM: Gaussian Embedding Modeling for Out-of-Distribution Detection in GUI Agents
  7. OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows
  8. ParaCook: On Time-Efficient Planning for Multi-Agent Systems
  9. The Confidence Paradox: Unveiling the Latent Discriminative Power of Diffusion Large Language Models in Mathematical Reasoning
  10. Can Knowledge be Transferred from Unimodal to Multimodal? Investigating the Transitivity of Multimodal Knowledge Editing
  11. Caution for the Environment: Multimodal LLM Agents are Susceptible to Environmental Distractions
  12. ChemAgent: Self-updating Memories in Large Language Models Improves Chemical Reasoning
  13. Do NOT Think That Much for 2+3=? On the Overthinking of Long Reasoning Models
  14. GuideBench: Benchmarking Domain-Oriented Guideline Following for LLM Agents
  15. Hidden Ghost Hand: Unveiling Backdoor Vulnerabilities in MLLM-Powered Mobile GUI Agents
  16. Look Before You Leap: Enhance Attention and Vigilance Regarding Harmful Content with GuidelineLLM
  17. MEGen: Generative Backdoor into Large Language Models via Model Editing
  18. OS-Kairos: Adaptive Interaction for MLLM-Powered GUI Agents
  19. RaSA: Rank-Sharing Low-Rank Adaptation
  20. Revisiting Data Auditing in Large Vision-Language Models
  21. Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early Decoding
  22. Stealing Knowledge from Auditable Datasets
  23. SynGhost: Invisible and Universal Task-agnostic Backdoor Attack via Syntactic Transfer
  24. Thoughts Are All Over the Place: On the Underthinking of Long Reasoning Models
  25. Watch Out Your Album! On the Inadvertent Privacy Memorization in Multi-Modal Large Language Models
  26. Acquiring Clean Language Models from Backdoor Poisoned Datasets by Downscaling Frequency Space
  27. Can Watermarks Survive Translation? On the Cross-lingual Consistency of Text Watermark for Large Language Models
  28. CoCo-Agent: A Comprehensive Cognitive MLLM Agent for Smartphone GUI Automation
  29. Dynamic Planning for LLM-based Graphical User Interface Automation
  30. Embedding Trajectory for Out-of-Distribution Detection in Mathematical Reasoning
  31. Fact-Driven Logical Reasoning for Machine Reading Comprehension
  32. From Multimodal LLM to Human-level AI: Modality, Instruction, Reasoning and Beyond
  33. GLaPE: Gold Label-agnostic Prompt Evaluation for Large Language Models
  34. Improving Machine Translation with Human Feedback: An Exploration of Quality Estimation as a Reward Model
  35. Investigating Multi-Hop Factual Shortcuts in Knowledge Editing of Large Language Models
  36. Measuring Bargaining Abilities of LLMs: A Benchmark and A Buyer-Enhancement Method
  37. MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning
  38. Meta-Reasoning: Semantics-Symbol Deconstruction for Large Language Models
  39. On the Robustness of Editing Large Language Models
  40. R-Judge: Benchmarking Safety Risk Awareness for LLM Agents
  41. Self-Prompting Large Language Models for Zero-Shot Open-Domain QA
  42. Structured Chemistry Reasoning with Large Language Models
  43. You Only Look at Screens: Multimodal Chain-of-Action Agents
    ACL 2024 · Zhuosheng Zhang