PPaperPicks

Chao Yang

Shanghai AI Lab, China

16 papers at tracked venues · 12 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. SHADOW: Dynamic-Aware Credit Assignment Against Long-Horizon Tasks
  2. Adversarial Preference Learning for Robust LLM Alignment
  3. Emergent Response Planning in LLMs
  4. VLMs can Aggregate Scattered Training Patches
  5. Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey
  6. Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
  7. Critic-Guided Decision Transformer for Offline Reinforcement Learning
  8. Emulated Disalignment: Safety Alignment for Large Language Models May Backfire!
  9. Inference-Time Language Model Alignment via Integrated Value Guidance
  10. LLaMA-Excitor: General Instruction Tuning via Indirect Feature Interaction
  11. Language-aware Visual Semantic Distillation for Video Question Answering
  12. MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
  13. RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis
  14. SEER: Facilitating Structured Reasoning and Explanation via Reinforcement Learning
  15. Safety of Multimodal Large Language Models on Images and Text
  16. Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models