PPaperPicks

Xueqian Wang

Tsinghua University, Graduate School at Shenzhen, Center for Artificial Intelligence and Robotics, China

22 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Surrogate-Assisted Evolutionary Multi-Agent Reinforcement Learning with Adaptive Fitness Evaluation
  2. AirTouch: A Low-Cost Versatile Visuotactile Feedback System for Enhanced Robotic Teleoperation
  3. D3-ARM: High-Dynamic, Dexterous and Fully Decoupled Cable-Driven Robotic Arm
  4. Entropy-based Activation Function Optimization: A Method on Searching Better Activation Functions
  5. FOSP: Fine-tuning Offline Safe Policy through World Models
  6. Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences Through f-Divergence Minimization
  7. Global-Guided Focal Neural Radiance Field for Large-Scale Scene Rendering
  8. Learning Pre-Trained Tacit Behavior for Efficient Multi-Agent Adversarial Coordination
  9. Lifelong Safety Alignment for Language Models
  10. Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
  11. MuxHand: A Cost-Effective and Compact Dexterous Robotic Hand Using Time-Division Multiplexing Mechanism
  12. Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
  13. Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
  14. Safety Reasoning with Guidelines
  15. Scalable MARL for Cooperative Exploration with Dynamic Robot Populations via Graph-Based Information Aggregation
  16. Twin Co-Adaptive Dialogue for Progressive Image Generation
  17. DFWLayer: Differentiable Frank-Wolfe Optimization Layer
  18. Decentralized Directed Collaboration for Personalized Federated Learning
  19. Learning Language-Conditioned Deformable Object Manipulation with Graph Dynamics
  20. Offline Goal-Conditioned Reinforcement Learning for Safety-Critical Tasks with Recovery Policy
  21. Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
  22. TPTU-v2: Boosting Task Planning and Tool Usage of Large Language Model-based Agents in Real-world Industry Systems