PPaperPicks

Yeyun Gong

35 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
  2. DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections
  3. Gold-Medal-Level Olympiad Geometry Solving with Efficient Heuristic Auxiliary Constructions
  4. How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
  5. Is Your Language Model Ready for Monetization Decisions?
  6. LayerNorm Induces Recency Bias in Transformer Decoders
  7. Too Long, Do Re-weighting for Efficient LLM Reasoning Compression
  8. Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
  9. Adapting LLM Agents with Universal Communication Feedback
  10. Alchemy: Amplifying Theorem-Proving Capability Through Symbolic Mutation
  11. Automated Proof Generation for Rust Code via Self-Evolution
  12. Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
  13. Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning
  14. Generative Prompt Internalization
  15. Integrative Decoding: Improving Factuality via Implicit Self-consistency
  16. Key-Point-Driven Data Synthesis with Its Enhancement on Mathematical Reasoning
  17. Optimizing Large Language Model Training Using FP4 Quantization
  18. Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
  19. PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
  20. Process-based Self-Rewarding Language Models
  21. Routing Mamba: Scaling State Space Models with Mixture-of-Experts Projection
  22. SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning
  23. Velocitune: A Velocity-based Dynamic Domain Reweighting Method for Continual Pre-training
  24. AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
  25. CMMLU: Measuring massive multitask language understanding in Chinese
  26. CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
  27. Competition-Level Problems are Effective LLM Evaluators
  28. Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
  29. Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
  30. LEAD: Liberal Feature-based Distillation for Dense Retrieval
  31. MS MARCO Web Search: A Large-scale Information-rich Web Dataset with Millions of Real Click Labels
  32. Not All Tokens Are What You Need for Pretraining
  33. Task Oriented In-Domain Data Augmentation
  34. Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
  35. ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving