PPaperPicks

Furu Wei

71 papers at tracked venues · 57 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
  2. MoCa: Modality-aware Continual Pre-training Makes Better Bidirectional Multimodal Embeddings
  3. Reasoning with Exploration: An Entropy Perspective
  4. Rectified Sparse Attention for Efficient Long-Sequence Generation
  5. Shorten After You're Right: Lazy Length Penalties for Reasoning RL
  6. Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
  7. Two Pathways to Truthfulness: On the Intrinsic Encoding of LLM Hallucinations
  8. VFA: Empowering Multilingual MLLMs via Vision-Free Adaptation
  9. ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation
  10. Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
  11. Autoregressive Speech Synthesis without Vector Quantization
  12. Bitnet.cpp: Efficient Edge Inference for Ternary LLMs
  13. Chain-of-Reasoning: Towards Unified Mathematical Reasoning in Large Language Models via a Multi-Paradigm Perspective
  14. Chain-of-Retrieval Augmented Generation
  15. Context-DPO: Aligning Language Models for Context-Faithfulness
  16. Data Selection via Optimal Control for Language Models
  17. Differential Transformer
  18. Examining False Positives under Inference Scaling for Mathematical Reasoning
  19. GeAR: Generation Augmented Retrieval
  20. Generative Representational Instruction Tuning
  21. Imagine While Reasoning in Space: Multimodal Visualization-of-Thought
  22. K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
  23. Little Giants: Synthesizing High-Quality Embedding Data at Scale
  24. MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
  25. Model as a Game: On Numerical and Spatial Consistency for Generative Games
  26. NL2Lean: Translating Natural Language into Lean 4 through Multi-Aspect Reinforcement Learning
  27. PEACE: Empowering Geologic Map Holistic Understanding with MLLMs
  28. Preference Optimization for Reasoning with Pseudo Feedback
  29. Rethinking DPO-Style Diffusion Aligning Frameworks
  30. Reward Reasoning Models
  31. Scaling Optimal LR Across Token Horizons
  32. Self-Boosting Large Language Models with Synthetic Preference Data
  33. Semi-Parametric Retrieval via Binary Bag-of-Tokens Index
  34. ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
  35. Textual Aesthetics in Large Language Models
  36. Think Only When You Need with Large Hybrid-Reasoning Models
  37. Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
  38. mmE5: Improving Multimodal Multilingual Embeddings via High-quality Synthetic Data
  39. Adapting Large Language Models via Reading Comprehension
  40. Boosting Text-to-Video Generative Model with MLLMs Feedback
  41. Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
  42. Fine-Tuning LLaMA for Multi-Stage Text Retrieval
  43. Grounding Multimodal Large Language Models to the World
  44. HD-Eval: Aligning Large Language Model Evaluators Through Hierarchical Criteria Decomposition
  45. Improving Text Embeddings with Large Language Models
  46. In-context Autoencoder for Context Compression in a Large Language Model
  47. Instruction Pre-Training: Language Models are Supervised Multitask Learners
  48. KOSMOS-E : Learning to Follow Instruction for Robotic Grasping
  49. Kosmos-G: Generating Images in Context with Multimodal Large Language Models
  50. Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
  51. Learning to Rank in Generative Retrieval
  52. LongEmbed: Extending Embedding Models for Long Context Retrieval
  53. Low-code LLM: Graphical User Interface over Large Language Models
  54. MathScale: Scaling Instruction Tuning for Mathematical Reasoning
  55. Mind's Eye of LLMs: Visualization-of-Thought Elicits Spatial Reasoning in Large Language Models
  56. MiniLLM: Knowledge Distillation of Large Language Models
  57. Mixture of LoRA Experts
  58. Multi-Head Mixture-of-Experts
  59. Multimodal Large Language Models Make Text-to-Image Generative Models Align Better
  60. Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
  61. PoSE: Efficient Context Window Extension of LLMs via Positional Skip-wise Training
  62. ResLoRA: Identity Residual Mapping in Low-Rank Adaption
  63. Respond in my Language: Mitigating Language Inconsistency in Response Generation based on Large Language Models
  64. SCALE: Synergized Collaboration of Asymmetric Language Translation Engines
  65. Se²: Sequential Example Selection for In-Context Learning
  66. Text Diffusion with Reinforced Conditioning
  67. TextDiffuser-2: Unleashing the Power of Language Models for Text Rendering
  68. Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration
  69. WavLLM: Towards Robust and Adaptive Speech Large Language Model
  70. You Only Cache Once: Decoder-Decoder Architectures for Language Models
  71. xRAG: Extreme Context Compression for Retrieval-augmented Generation with One Token