PPaperPicks

Donglin Wang

35 papers at tracked venues · 26 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Activation-wise Propagation: A One-Timestep Strategy for Spiking Neural Networks
  2. Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
  3. Filter, Correlate, Compress: Training-Free Token Reduction for MLLM Acceleration
  4. ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver
  5. Rethinking Target Label Conditioning in Adversarial Attacks: A 2D Tensor-Guided Generative Approach
  6. VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model
  7. Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
  8. CARP: Visuomotor Policy Learning via Coarse-to-Fine Autoregressive Prediction
  9. CSL-L2M: Controllable Song-Level Lyric-to-Melody Generation Based on Conditional Transformer with Fine-Grained Lyric and Musical Controls
  10. Cobra: Extending Mamba to Multi-Modal Large Language Model for Efficient Inference
  11. GEVRM: Goal-Expressive Video Generation Model For Robust Visual Manipulation
  12. Integrating Trajectory Optimization and Reinforcement Learning for Quadrupedal Jumping with Terrain-Adaptive Landing
  13. MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning
  14. MoRE: Unlocking Scalability in Reinforcement Learning for Quadruped Vision-Language-Action Models
  15. PD-VLA: Accelerating Vision-Language-Action Model Integrated with Action Chunking via Parallel Decoding
  16. Quart-Online: Latency-Free Multimodal Large Language Model for Quadruped Robot Learning
  17. ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning
  18. Rethinking Latent Redundancy in Behavior Cloning: An Information Bottleneck Approach for Robot Manipulation
  19. SSR: Enhancing Depth Perception in Vision-Language Models via Rationale-Guided Spatial Reasoning
  20. Score-Based Diffusion Policy Compatible with Reinforcement Learning via Optimal Transport
  21. Stay Hungry, Keep Learning: Sustainable Plasticity for Deep Reinforcement Learning
  22. VLAS: Vision-Language-Action Model with Speech Instructions for Customized Robot Manipulation
  23. Beyond OOD State Actions: Supported Cross-Domain Offline Reinforcement Learning
  24. DIDI: Diffusion-Guided Diversity for Offline Behavioral Generation
  25. Expressive Forecasting of 3D Whole-Body Human Motions
  26. GeRM: A Generalist Robotic Model with Mixture-of-experts for Quadruped Robot
  27. Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
  28. Nash CoT: Multi-Path Inference with Preference Equilibrium
  29. PiTe: Pixel-Temporal Alignment for Large Video-Language Model
  30. ProFD: Prompt-Guided Feature Disentangling for Occluded Person Re-Identification
  31. Prompt-Based Distribution Alignment for Unsupervised Domain Adaptation
  32. QUAR-VLA: Vision-Language-Action Model for Quadruped Robots
  33. RL2AC: Reinforcement Learning-based Rapid Online Adaptive Control for Legged Robot Robust Locomotion
  34. Reinformer: Max-Return Sequence Modeling for Offline RL
  35. Troika: Multi-Path Cross-Modal Traction for Compositional Zero-Shot Learning