PPaperPicks

Teng Xiao

21 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. From AR to Diffusion: Efficiently Adapting Large Language Models with Strictly Causal and Elastic Horizons
  2. From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time Scaling
  3. Incentivizing Strong Reasoning from Weak Supervision
  4. Scaling and Transferability of Annealing Strategies in Large Language Model Training
  5. DSPO: Direct Score Preference Optimization for Diffusion Model Alignment
  6. Dialogue-RAG: Enhancing Retrieval for LLMs via Node-Linking Utterance Rewriting
  7. Fact-Level Calibration and Correction for Long-Form Generations
  8. Inference-time Alignment in Continuous Space
  9. InfoPO: On Mutual Information Maximization for Large Language Model Alignment
    NAACL 2025 · Teng Xiao
  10. Leveraging Invariant Principle for Heterophilic Graph Structure Distribution Shifts
  11. On a Connection Between Imitation Learning and RLHF
    ICLR 2025 · Teng Xiao
  12. Reinforcement Learning for Large Language Models via Group Preference Reward Shaping
  13. Revisiting Scaling Laws for Language Models: The Role of Data Quality and Training Strategies
  14. SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
    ICLR 2025 · Teng Xiao
  15. Simple Distillation for One-Step Diffusion Models
  16. The 1st Workshop on LLM Agents for Social Simulation
  17. Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
    NeurIPS 2024 · Teng Xiao
  18. Efficient Contrastive Learning for Fast and Accurate Inference on Graphs
    ICML 2024 · Teng Xiao
  19. How to Leverage Demonstration Data in Alignment for Large Language Model? A Self-Imitation Learning Perspective
    EMNLP 2024 · Teng Xiao
  20. In-Context Sharpness as Alerts: An Inner Representation Perspective for Hallucination Mitigation
  21. Learning to Reweight for Generalizable Graph Neural Network