PPaperPicks

Xue Wang

12 papers at tracked venues · 11 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Incentivizing Strong Reasoning from Weak Supervision
  2. SimDiff: Simpler Yet Better Diffusion Model for Time Series Point Forecasting
  3. AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
  4. Debiasing Multimodal Large Language Models via Penalization of Language Priors
  5. Larger or Smaller Reward Margins to Select Preferences for LLM Alignment?
  6. Learning Bayesian Nash Equilibrium in Auction Games via Approximate Best Response
  7. MISA: Memory-Efficient LLMs Optimization with Module-wise Importance Sampling
  8. MM-RLHF: The Next Step Forward in Multimodal LLM Alignment
  9. RePO: Understanding Preference Learning Through ReLU-Based Optimization
  10. Auctionformer: A Unified Deep Learning Algorithm for Solving Equilibrium Strategies in Auction Games
  11. CARD: Channel Aligned Robust Blend Transformer for Time Series Forecasting
    ICLR 2024 · Xue Wang
  12. Structured Model Probing: Empowering Efficient Transfer Learning by Structured Regularization