PPaperPicks

Hang Yan

Shanghai AI Laboratory, Shanghai, China

21 papers at tracked venues · 18 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning
  2. What Makes a Good Speech Tokenizer for LLM-Centric Speech Generation? A Systematic Study
  3. Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
  4. ReAttention: Training-Free Infinite Context with Finite Attention Scope
  5. What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices
  6. AdaLomo: Low-memory Optimization with Adaptive Learning Rate
  7. AlchemistCoder: Harmonizing and Eliciting Code Capability by Hindsight Tuning on Multi-source Data
  8. AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
  9. Balanced Data Sampling for Language Model Training with Clustering
  10. Benchmarking Chinese Commonsense Reasoning of LLMs: From Chinese-Specifics to Reasoning-Memorization Correlations
  11. Code Needs Comments: Enhancing Code LLMs with Comment Augmentation
  12. Empowering and Assessing the Utility of Large Language Models in Crop Science
  13. F-Eval: Asssessing Fundamental Abilities with Refined Evaluation Methods
  14. Identifying Semantic Induction Heads to Understand In-Context Learning
  15. InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD
  16. Length Generalization of Causal Transformers without Position Encoding
  17. Linear Alignment: A Closed-form Solution for Aligning Human Preferences without Tuning and Feedback
  18. LongWanjuan: Towards Systematic Measurement for Long Text Quality
  19. Scaling Laws of RoPE-based Extrapolation
  20. Turn Waste into Worth: Rectifying Top-k Router of MoE
  21. Unified Active Retrieval for Retrieval Augmented Generation