PPaperPicks

Li Shen

Sun Yat-sen University Shenzhen Campus, School of Cyber Science and Technology, Shenzhen, China

91 papers at tracked venues · 83 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CTRAP: Embedding Collapse Trap to Safeguard Large Language Models from Harmful Fine-Tuning
  2. Efficient Transformer Parameter Reuse via Zero-Token Mechanism
  3. O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning
  4. Reason-KE++: Aligning the Process, Not Just the Outcome, for Faithful LLM Knowledge Editing
  5. Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling
  6. Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization
  7. Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
  8. AlphaDecay: Module-wise Weight Decay for Heavy-Tailed Balancing in LLMs
  9. Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
  10. CHPO: Constrained Hybrid-action Policy Optimization for Reinforcement Learning
  11. Combatting Dimensional Collapse in LLM Pre-Training Data via Submodular File Selection
  12. Contextual Bandits for Unbounded Context Distributions
  13. Continual Model Merging without Data: Dual Projections for Balancing Stability and Plasticity
  14. Decision Mixer: Integrating Long-term and Local Dependencies via Dynamic Token Selection for Decision-Making
  15. Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models
  16. Dynamic Analysis and Adaptive Discriminator for Fake News Detection
  17. Dynamic Neural Fortresses: An Adaptive Shield for Model Extraction Defense
  18. DynamicKV: Task-Aware Adaptive KV Cache Compression for Long Context LLMs
  19. Edit Once, Update Everywhere: A Simple Framework for Cross-Lingual Knowledge Synchronization in LLMs
  20. Effective Policy Learning for Multi-Agent Online Coordination Beyond Submodular Objectives
  21. Efficient Federated Learning against Byzantine Attacks and Data Heterogeneity via Aggregating Normalized Gradients
  22. Enhancing Learning with Label Differential Privacy by Vector Approximation
  23. GraphCL: Graph-based Clustering for Semi-Supervised Medical Image Segmentation
  24. Hypernetwork Aggregation for Decentralized Personalized Federated Learning
  25. Investigating the Role of Weight Decay in Enhancing Nonconvex SGD
  26. Layer as Puzzle Pieces: Compressing Large Language Models through Layer Concatenation
  27. LoRA Recycle: Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
  28. Mask-Enhanced Autoregressive Prediction: Pay Less Attention to Learn More
  29. Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
  30. Merging on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
  31. Mitigating the Backdoor Effect for Multi-Task Model Merging via Safety-Aware Subspace
  32. Mix Data or Merge Models? Balancing the Helpfulness, Honesty, and Harmlessness of Large Language Model via Model Merging
  33. MixPrompt: Efficient Mixed Prompting for Multimodal Semantic Segmentation
  34. Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent
  35. MuGS: Multi-Baseline Generalizable Gaussian Splatting Reconstruction
  36. Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search
  37. Multinoulli Extension: A Lossless Yet Effective Probabilistic Framework for Subset Selection over Partition Constraints
  38. Near-Optimal Online Learning for Multi-Agent Submodular Coordination: Tight Approximation and Communication Efficiency
  39. Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
  40. Open-Vocabulary Customization from CLIP via Data-Free Knowledge Distillation
  41. PEARL: Towards Permutation-Resilient LLMs
  42. Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
  43. Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
  44. R1-ShareVL: Incentivizing Reasoning Capabilities of Multimodal Large Language Models via Share-GRPO
  45. Retrieval-Augmented Perception: High-resolution Image Perception Meets Visual RAG
  46. RoMa: A Robust Model Watermarking Scheme for Protecting IP in Diffusion Models
  47. Robust Knowledge Editing via Explicit Reasoning Chains for Distractor-Resilient Multi-Hop QA
  48. Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
  49. Safety Reasoning with Guidelines
  50. Self-Verification Provably Prevents Model Collapse in Recursive Synthetic Training
  51. Tackling Continual Offline RL through Selective Weights Activation on Aligned Spaces
  52. Targeted Low-rank Refinement: Enhancing Sparse Language Models with Precision
    ICML 2025 · Li Shen
  53. Understanding the Stability-based Generalization of Personalized Federated Learning
  54. Unveiling the Power of Multiple Gossip Steps: A Stability-Based Generalization Analysis in Decentralized Training
  55. Vad-R1: Towards Video Anomaly Reasoning via Perception-to-Cognition Chain-of-Thought
  56. Value-Guided Decision Transformer: A Unified Reinforcement Learning Framework for Online and Offline Settings
  57. Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning
  58. A Huber Loss Minimization Approach to Mean Estimation under User-level Differential Privacy
  59. A Unified and General Framework for Continual Learning
  60. A-FedPD: Aligning Dual-Drift is All Federated Primal-Dual Learning Needs
  61. AdaMerging: Adaptive Model Merging for Multi-Task Learning
  62. DREAM: Dual Structured Exploration with Mixup for Open-set Graph Domain Adaption
  63. Decentralized Directed Collaboration for Personalized Federated Learning
  64. Decomposed Prompt Decision Transformer for Efficient Unseen Task Generalization
  65. Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer
  66. Embodied Multi-Modal Agent trained by an LLM from a Parallel TextWorld
  67. Free: Faster and Better Data-Free Meta-Learning
  68. Generalization Analysis of Stochastic Weight Averaging with General Sampling
  69. HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
  70. Improving Non-Transferable Representation Learning by Harnessing Content and Style
  71. Is C4 Dataset Optimal for Pruning? An Investigation of Calibration Data for LLM Pruning
  72. Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?
  73. Learning Multi-Agent Communication from Graph Modeling Perspective
  74. Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
  75. MuEP: A Multimodal Benchmark for Embodied Planning with Foundation Models
  76. Neural Network Approximation for Pessimistic Offline Reinforcement Learning
  77. OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
  78. POCE: Primal Policy Optimization with Conservative Estimation for Multi-constraint Offline Reinforcement Learning
  79. Parameter-Efficient Multi-Task Model Fusion with Partial Linearization
  80. PrimKD: Primary Modality Guided Multimodal Fusion for RGB-D Semantic Segmentation
  81. Q-value Regularized Transformer for Offline Reinforcement Learning
  82. Representation Surgery for Multi-Task Model Merging
  83. Revisiting Knowledge Distillation for Autoregressive Language Models
  84. Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
  85. Sheared Backpropagation for Fine-Tuning Foundation Models
  86. Sparse Model Inversion: Efficient Inversion of Vision Transformers for Data-Free Applications
  87. Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
  88. Training A Secure Model Against Data-Free Model Extraction
  89. Uncovering, Explaining, and Mitigating the Superficial Safety of Backdoor Defense
  90. WisdoM: Improving Multimodal Sentiment Analysis by Fusing Contextual World Knowledge
  91. Your Transferability Barrier is Fragile: Free-Lunch for Transferring the Non-Transferable Learning