PPaperPicks

Shujian Huang

38 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAMΔ Integration into Upcycled MoE
  2. How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
  3. Improving Long-Context Translation via Self-Supervised Dual Learning
  4. PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning
  5. Reasoning While Asking: Transforming Reasoning Large Language Models from Passive Solvers to Proactive Inquirers
  6. Understanding New-Knowledge-Induced Factual Hallucinations in LLMs: Analysis and Interpretation
  7. Alleviating Distribution Shift in Synthetic Data for Machine Translation Quality Estimation
  8. BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
  9. DPLM-2: A Multimodal Diffusion Protein Language Model
  10. Elucidating the Design Space of Multimodal Protein Language Models
  11. EnAnchored-X2X: English-Anchored Optimization for Many-to-Many Translation
  12. Investigating and Scaling up Code-Switching for Multilingual Language Model Pre-Training
  13. Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
  14. MoE-LPR: Multilingual Extension of Large Language Models Through Mixture-of-Experts with Language Priors Routing
  15. Process-based Self-Rewarding Language Models
  16. R-PRM: Reasoning-Driven Process Reward Modeling
  17. SDGO: Self-Discrimination-Guided Optimization for Consistent Safety in Large Language Models
  18. TRANS-ZERO: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
  19. Understanding LLMs' Cross-Lingual Context Retrieval: How Good It Is And Where It Comes From
  20. Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
  21. A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily
  22. Diffusion Language Models Are Versatile Protein Learners
  23. EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
  24. Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
  25. Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge
  26. Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
  27. Hallu-PI: Evaluating Hallucination in Multi-modal Large Language Models within Perturbed Inputs
  28. Large Language Models are Limited in Out-of-Context Knowledge Reasoning
  29. Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
  30. MAPO: Advancing Multilingual Reasoning through Multilingual-Alignment-as-Preference Optimization
  31. MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
  32. Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language Models
  33. MultiSQL: A Schema-Integrated Context-Dependent Text2SQL Dataset with Diverse SQL Operations
  34. Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping
  35. Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
  36. Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only Shallowly
  37. PreAlign: Boosting Cross-Lingual Transfer by Early Establishment of Multilingual Alignment
  38. Question Translation Training for Better Multilingual Reasoning