PPaperPicks

Dacheng Tao

Nanyang Technological University, Singapore

149 papers at tracked venues · 132 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
  2. Bridging the Tokenizer Gap: Semantics and Distribution-aware Knowledge Transfer for Unbiased Cross-Tokenizer Distillation
  3. CogniTrust: Cognitive Memory-Driven Verifiable Supervision for Robust Hashing
  4. Controllable Contamination Detection for Reliable LLM Evaluation with Statistical Guarantees
  5. Distillation Traps and Guards: A Calibration Knob for LLM Distillability
  6. Erasing Without Remembering: Implicit Knowledge Forgetting in Large Language Models
  7. Free-Form Scene Editor: Enabling Multi-Round Object Manipulation Like in a 3D Engine
  8. GeometryZero: Advancing Geometry Solving via Group Contrastive Policy Optimization
  9. Lightning Fast Caching-based Parallel Denoising Prediction for Accelerating Talking Head Generation
  10. O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning
  11. Offline Behavioral Data Selection
  12. Powering Verifiable Learning via Automated Evolutionary Data Synthesis
  13. Reason-KE++: Aligning the Process, Not Just the Outcome, for Faithful LLM Knowledge Editing
  14. Reasoning-Guided Exploration for Online DPO
  15. RouteMoA: Dynamic Routing without Pre-Inference Boosts Efficient Mixture-of-Agents
  16. SAFER: A Controllable Safeguard for LLMs against Backdoor Attacks
  17. SEAD: A Surrogate-free Label-only Membership Inference Attack against Pre-trained LLMs with Semantic-Aware Density
  18. SRD: Reinforcement-Learned Semantic Perturbation for Backdoor Defense in VLMs
  19. The Bitter Lesson of Diffusion Language Models for Agentic Workflows: A Comprehensive Reality Check
  20. Time-Frequency Token Advantage Clipping for Training Efficient Large Reasoning Model
  21. A Statistical Approach for Controlled Training Data Detection
  22. A Theoretical Perspective: How to Prevent Model Collapse in Self-consuming Training Loops
  23. Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization
  24. AdaVideoRAG: Omni-Contextual Adaptive Retrieval-Augmented Efficient Long Video Understanding
  25. Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
  26. AiDE-Q: Synthetic Labeled Datasets Can Enhance Learning Models for Quantum Property Estimation
  27. Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
  28. AsymRnR: Video Diffusion Transformers Acceleration with Asymmetric Reduction and Restoration
  29. Be Confident: Uncovering Overfitting in MLLM Multi-Task Tuning
  30. CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
  31. Combatting Dimensional Collapse in LLM Pre-Training Data via Submodular File Selection
  32. Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
  33. CopyrightShield: Enhancing Diffusion Model Security Against Copyright Infringement Attacks
  34. D2GS: Dense Depth Regularization for LiDAR-free Urban Scene Reconstruction
  35. Decision Mixer: Integrating Long-term and Local Dependencies via Dynamic Token Selection for Decision-Making
  36. Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing
  37. Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models
  38. Dynamic Neural Fortresses: An Adaptive Shield for Model Extraction Defense
  39. Dynamic Parallel Tree Search for Efficient LLM Reasoning
  40. ECLR'25: 2nd Workshop on Efficient Computing Under Limited Resources: Visual Computing
  41. ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
  42. Edit Once, Update Everywhere: A Simple Framework for Cross-Lingual Knowledge Synchronization in LLMs
  43. Effective Policy Learning for Multi-Agent Online Coordination Beyond Submodular Objectives
  44. Empowering Large Language Models for Time Series Forecasting with Patterns and Semantics
  45. Energy-based Backdoor Defense Against Federated Graph Learning
  46. Enhancing Input-Label Mapping in In-Context Learning with Contrastive Decoding
  47. FreDF: Learning to Forecast in the Frequency Domain
  48. Free-Form Motion Control: Controlling the 6D Poses of Camera and Objects in Video Generation
  49. Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning
  50. Human-Imperceptible, Machine-Recognizable Images
  51. ICLShield: Exploring and Mitigating In-Context Learning Backdoor Attacks
  52. Improving Complex Reasoning over Knowledge Graph with Logic-Aware Curriculum Tuning
  53. KaFT: Knowledge-aware Fine-tuning for Boosting LLMs' Domain-specific Question-Answering Performance
  54. LLM Data Selection and Utilization via Dynamic Bi-level Optimization
  55. Learn from Downstream and Be Yourself in Multimodal Large Language Models Fine-Tuning
  56. Learning system dynamics without forgetting
  57. LoRA Recycle: Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
  58. MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI
  59. Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
  60. Merging on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
  61. MetAdv: A Unified and Interactive Adversarial Testing Platform for Autonomous Driving
  62. Modeling All Response Surfaces in One for Conditional Search Spaces
  63. Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search
  64. Multinoulli Extension: A Lossless Yet Effective Probabilistic Framework for Subset Selection over Partition Constraints
  65. Near-Optimal Online Learning for Multi-Agent Submodular Coordination: Tight Approximation and Communication Efficiency
  66. Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
  67. Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
  68. NoVo: Norm Voting off Hallucinations with Attention Heads in Large Language Models
  69. On Geometry-Enhanced Parameter-Efficient Fine-Tuning for 3D Scene Segmentation
  70. Open-Vocabulary Customization from CLIP via Data-Free Knowledge Distillation
  71. Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
  72. Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
  73. R1-ShareVL: Incentivizing Reasoning Capabilities of Multimodal Large Language Models via Share-GRPO
  74. R1-VL: Learning to Reason with Multimodal Large Language Models via Step-Wise Group Relative Policy Optimization
  75. Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
  76. Rethink Sparse Signals for Pose-Guided Text-to-Image Generation
  77. Retrieval-Augmented Perception: High-resolution Image Perception Meets Visual RAG
  78. Revisiting Backdoor Attacks against Large Vision-Language Models from Domain Shift
  79. Robust Knowledge Editing via Explicit Reasoning Chains for Distractor-Resilient Multi-Hop QA
  80. Runaway is Ashamed, But Helpful: On the Early-Exit Behavior of Large Language Model-based Agents in Embodied Environments
  81. SEGA: Shaping Semantic Geometry for Robust Hashing under Noisy Supervision
  82. SPAZER: Spatial-Semantic Progressive Reasoning Agent for Zero-shot 3D Visual Grounding
  83. Safety Reasoning with Guidelines
  84. SeRL: Self-play Reinforcement Learning for Large Language Models with Limited Data
  85. Self-Verification Provably Prevents Model Collapse in Recursive Synthetic Training
  86. SkipNode: On Alleviating Performance Degradation for Deep Graph Convolutional Networks (Extended Abstract)
  87. Supervised Optimism Correction: Be Confident When LLMs Are Sure
  88. T2V-OptJail: Discrete Prompt Optimization for Text-to-Video Jailbreak Attacks
  89. Tackling Continual Offline RL through Selective Weights Activation on Aligned Spaces
  90. The Energy Loss Phenomenon in RLHF: A New Perspective on Mitigating Reward Hacking
  91. UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
  92. VORTA: Efficient Video Diffusion via Routing Sparse Attention
  93. Value-Guided Decision Transformer: A Unified Reinforcement Learning Framework for Online and Offline Settings
  94. VisuoThink: Empowering LVLM Reasoning with Multimodal Tree Search
  95. A-FedPD: Aligning Dual-Drift is All Federated Primal-Dual Learning Needs
  96. AdaMerging: Adaptive Model Merging for Multi-Task Learning
  97. Adaptive Time-Stepping Schedules for Diffusion Models
  98. Confronting Reward Overoptimization for Diffusion Models: A Perspective of Inductive and Primacy Biases
  99. Convergence of Bayesian Bilevel Optimization
  100. DB-LLM: Accurate Dual-Binarization for Efficient LLMs
  101. Decomposed Prompt Decision Transformer for Efficient Unseen Task Generalization
  102. Deep Graph Mating
  103. Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer
  104. Error Analysis Prompting Enables Human-Like Translation Evaluation in Large Language Models
  105. Fisher Calibration for Backdoor-Robust Heterogeneous Federated Learning
  106. Free: Faster and Better Data-Free Meta-Learning
  107. Generalization Analysis of Stochastic Weight Averaging with General Sampling
  108. GoMatching: A Simple Baseline for Video Text Spotting via Long and Short Term Matching
  109. Graph Contrastive Learning Meets Graph Meta Learning: A Unified Method for Few-shot Node Tasks
  110. HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting
  111. HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
  112. InfoRM: Mitigating Reward Hacking in RLHF via Information-Theoretic Reward Modeling
  113. Joint Input and Output Coordination for Class-Incremental Learning
  114. LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
  115. LanEvil: Benchmarking the Robustness of Lane Detection to Environmental Illusions
  116. Learning Multi-Agent Communication from Graph Modeling Perspective
  117. Learning from Imperfect Data: Towards Efficient Knowledge Distillation of Autoregressive Language Models for Text-to-SQL
  118. Local-consistent Transformation Learning for Rotation-invariant Point Cloud Analysis
  119. MG-Net: Learn to Customize QAOA with Circuit Depth Awareness
  120. Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
  121. Multi-Granularity Hand Action Detection
  122. Multi-Step Denoising Scheduled Sampling: Towards Alleviating Exposure Bias for Diffusion Models
  123. OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
  124. Offline Behavior Distillation
  125. One For All: Towards Training One Graph Model For All Classification Tasks
  126. One More Step: A Versatile Plug-and-Play Module for Rectifying Diffusion Schedule Flaws and Enhancing Low-Frequency Controls
  127. Parameter-Efficient Multi-Task Model Fusion with Partial Linearization
  128. Q-value Regularized Transformer for Offline Reinforcement Learning
  129. ROSE Doesn't Do That: Boosting the Safety of Instruction-Tuned Large Language Models with Reverse Prompt Contrastive Decoding
  130. Representation Surgery for Multi-Task Model Merging
  131. Revisiting Catastrophic Forgetting in Large Language Model Tuning
  132. Revisiting Demonstration Selection Strategies in In-Context Learning
  133. Revisiting Knowledge Distillation for Autoregressive Language Models
  134. Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
  135. Self-Powered LLM Modality Expansion for Large Speech-Text Models
  136. Semantic-focused Patch Tokenizer with Multi-branch Mixer for Visual Place Recognition
  137. Sheared Backpropagation for Fine-Tuning Foundation Models
  138. SimDistill: Simulated Multi-Modal Distillation for BEV 3D Object Detection
  139. Sparse Model Inversion: Efficient Inversion of Vision Transformers for Data-Free Applications
  140. Speech Sense Disambiguation: Tackling Homophone Ambiguity in End-to-End Speech Translation
  141. Synergy of Sight and Semantics: Visual Intention Understanding with CLIP
  142. TD²-Net: Toward Denoising and Debiasing for Video Scene Graph Generation
  143. Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
  144. Topology-aware Embedding Memory for Continual Learning on Expanding Networks
  145. Towards Theoretical Understandings of Self-Consuming Generative Models
  146. Uncertainty Aware Learning for Language Model Alignment
  147. UniMix: Towards Domain Adaptive and Generalizable LiDAR Semantic Segmentation in Adverse Weather
  148. When ControlNet Meets Inexplicit Masks: A Case Study of ControlNet on its Contour-following Ability
  149. WisdoM: Improving Multimodal Sentiment Analysis by Fusing Contextual World Knowledge