PPaperPicks

Yiming Yang

Carnegie Mellon University, Language Technologies Institute, Pittsburgh, PA, USA

24 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
  2. Agentic-R1: Distilled Dual-Strategy Reasoning
  3. Direct Preference Optimization of Video Large Multimodal Models from Language Model Reward
  4. Enhancing Training Data Attribution with Representational Optimization
  5. Few-shot Personalization of LLMs with Mis-aligned Responses
  6. Improve Vision Language Model Chain-of-thought Reasoning
  7. Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
  8. Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for LLM Problem-Solving
  9. Lean-STaR: Learning to Interleave Thinking and Proving
  10. Maximal Update Parametrization and Zero-Shot Hyperparameter Transfer for Fourier Neural Operators
  11. Optimizing Temperature for Language Models with Multi-Sample Inference
  12. Regularized Langevin Dynamics for Combinatorial Optimization
  13. SORREL: Suboptimal-Demonstration-Guided Reinforcement Learning for Learning to Branch
  14. Self-Play Preference Optimization for Language Model Alignment
  15. Step-by-Step Reasoning for Math Problems via Twisted Sequential Monte Carlo
  16. Aligning Large Multimodal Models with Factually Augmented RLHF
  17. AutoMix: Automatically Mixing Language Models
  18. Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision
  19. Functional Interpolation for Relative Positions improves Long Context Transformers
  20. In-Context Principle Learning from Mistakes
  21. Learning Performance-Improving Code Edits
  22. Learning to Correct for QA Reasoning with Black-box LLMs
  23. Representation Learning and Information Retrieval
    SIGIR 2024 · Yiming Yang
  24. SALMON: Self-Alignment with Instructable Reward Models