PPaperPicks

Bei Li

30 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search
  2. GRAM-R²: Self-Training Generative Foundation Reward Models for Reward Reasoning
  3. LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
  4. MTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks
  5. NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
  6. On the Emotion Understanding of Synthesized Speech
  7. Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
  8. RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
  9. SageLM: A Multi-aspect and Explainable Large Language Model for Speech Judgement
  10. Tuning Medical Foundation Models for Inner Ear Temporal CT Analysis with Plug-and-play Domain Knowledge Aggregator
  11. Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
  12. Earlier Tokens Contribute More: Learning Direct Preference Optimization From Temporal Decay Perspective
  13. GRAM: A Generative Foundation Reward Model for Reward Generalization
  14. IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
  15. Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
  16. MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
  17. ReMamba: Equip Mamba with Effective Long-Sequence Modeling
  18. Selecting Demonstrations for Many-Shot In-Context Learning via Gradient Matching
  19. TCPO: Thought-Centric Preference Optimization for Effective Embodied Decision-making
  20. Clustering and Ranking: Diversity-preserved Instruction Selection through Expert-aligned Quality Estimation
  21. CodeAgent: Autonomous Communicative Agents for Code Review
  22. Connecting Large Language Models with Evolutionary Algorithms Yields Powerful Prompt Optimizers
  23. EIT: Enhanced Interactive Transformer
  24. ESRL: Efficient Sampling-Based Reinforcement Learning for Sequence Generation
  25. Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-Context Models
  26. Hybrid Alignment Training for Large Language Models
  27. PartialFormer: Modeling Part Instead of Whole for Machine Translation
  28. Predictor-Corrector Enhanced Transformers with Exponential Moving Average Coefficient Learning
    NeurIPS 2024 · Bei Li
  29. Revealing the Parallel Multilingual Learning within Large Language Models
  30. Scaling Laws Across Model Architectures: A Comparative Analysis of Dense and MoE Models in Large Language Models