PPaperPicks

Yaodong Yang

Peking University, Institute for AI, Beijing, China

62 papers at tracked venues · 54 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus
  2. Communication-Efficient Desire Alignment for Proactive Embodied Human-Agent Interaction
  3. DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping
  4. SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning
  5. SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning
  6. SafeMT: Multi-turn Safety for Multimodal Language Models
  7. Uncovering Strategic Egoism Behaviors in Large Language Models
  8. When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning
  9. Adaptive Visuo-Tactile Fusion with Predictive Force Attention for Dexterous Manipulation
  10. Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
  11. Benchmarking Multi-National Value Alignment for Large Language Models
  12. Boosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA
  13. Carbon Trading Supply Chain Management Based on Constrained Deep Reinforcement Learning
  14. DexFlyWheel: A Scalable and Self-improving Data Generation Framework for Dexterous Manipulation
  15. Differentiable Information Enhanced Model-Based Reinforcement Learning
  16. Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models
  17. Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
  18. Enhancing LLM-Based Social Bot via an Adversarial Learning Framework
  19. Falcon: Fast Visuomotor Policies via Partial Denoising
  20. Generative RLHF-V: Learning Principles from Multi-modal Human Preference
  21. Hierarchical Multi-Agent Framework for Dynamic Macroeconomic Modelling Using Large Language Models
  22. In-Context Editing: Learning Knowledge from Self-Induced Distributions
  23. InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
  24. Language Models Resist Alignment: Evidence From Data Compression
  25. Learning Uniformly Distributed Embedding Clusters of Stylistic Skills for Physically Simulated Characters
  26. Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability
  27. Magnetic Preference Optimization: Achieving Last-iterate Convergence for Language Model Alignment
  28. Mean Field Correlated Imitation Learning
  29. Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization
  30. PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
  31. RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
  32. Reward Generalization in RLHF: A Topological Perspective
  33. Risk-aware Direct Preference Optimization under Nested Risk Measure
  34. SAE-V: Interpreting Multimodal Models for Enhanced Alignment
  35. STAR: Efficient Preference-based Reinforcement Learning via Dual Regularization
  36. Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
  37. SafeLawBench: Towards Safe Alignment of Large Language Models
  38. SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
  39. Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
  40. Social World Model-Augmented Mechanism Design Policy Learning
  41. Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction
  42. Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
  43. World Models Should Prioritize the Unification of Physical and Social Dynamics
  44. A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning
  45. A Summary of Online Markov Decision Processes with Non-oblivious Strategic Adversary
  46. Aligner: Efficient Alignment by Learning to Correct
  47. AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
  48. Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game
  49. CivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents
  50. Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning
  51. End-to-End Neuro-Symbolic Reinforcement Learning with Textual Explanations
  52. Maximum Entropy Heterogeneous-Agent Reinforcement Learning
  53. Off-Agent Trust Region Policy Optimization
  54. Panacea: Pareto Alignment via Preference Adaptation for LLMs
  55. ProAgent: Building Proactive Cooperative Agents with Large Language Models
  56. ProgressGym: Alignment with a Millennium of Moral Progress
  57. STAS: Spatial-Temporal Return Decomposition for Solving Sparse Rewards Problems in Multi-agent Reinforcement Learning
  58. Safe RLHF: Safe Reinforcement Learning from Human Feedback
  59. Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
  60. SafeDreamer: Safe Reinforcement Learning with World Models
  61. SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
  62. Scalable Constrained Policy Optimization for Safe Multi-agent Reinforcement Learning