P
PaperPicks
Conferences
Jie Fu
Shanghai AI Lab, China
38 papers at tracked venues · 27 at CORE A* · active 2024–2025
DBLP profile ↗
ORCID 0000-0002-4494-843X ↗
Google Scholar ↗
Homepage ↗
Venues
ACL
×11
ICLR
×9
NAACL
×6
EMNLP
×3
NeurIPS
×3
AAAI
×1
ACM MM
×1
ECCV
×1
ICCV
×1
ICML
×1
IJCAI
×1
Frequent coauthors
Zihan Qiu
DBLP profile ↗
ORCID search ↗
×3
Zekun Moore Wang
DBLP profile ↗
ORCID search ↗
×2
Yizhi Li
DBLP profile ↗
ORCID search ↗
×2
Noah Wang
DBLP profile ↗
ORCID search ↗
×2
Wenyu Du
DBLP profile ↗
ORCID search ↗
×2
Ka Man Lo
DBLP profile ↗
ORCID search ↗
×1
Yuelin Bai
DBLP profile ↗
ORCID search ↗
×1
Yihan Zhang
DBLP profile ↗
ORCID search ↗
×1
Yifan Zhang
DBLP profile ↗
ORCID search ↗
×1
Xidong Wang
DBLP profile ↗
ORCID search ↗
×1
Lu Li
DBLP profile ↗
ORCID search ↗
×1
Xingwei Qu
DBLP profile ↗
ORCID search ↗
×1
Papers
A Closer Look into Mixture-of-Experts in Large Language Models
NAACL 2025
·
Ka Man Lo
DBLP profile ↗
ORCID search ↗
COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning
NAACL 2025
·
Yuelin Bai
DBLP profile ↗
ORCID search ↗
Enhancing Language Model Hypernetworks with Restart: A Study on Optimization
NAACL 2025
·
Yihan Zhang
DBLP profile ↗
ORCID search ↗
Finite State Automata Inside Transformers with Chain-of-Thought: A Mechanistic Study on State Tracking
ACL 2025
·
Yifan Zhang
DBLP profile ↗
ORCID search ↗
Huatuo-26M, a Large-scale Chinese Medical QA Dataset
NAACL 2025
·
Xidong Wang
DBLP profile ↗
ORCID search ↗
Layerwise Recurrent Router for Mixture-of-Experts
ICLR 2025
·
Zihan Qiu
DBLP profile ↗
ORCID search ↗
MAP: Low-compute Model Merging with Amortized Pareto Fronts via Quadratic Approximation
ICLR 2025
·
Lu Li
DBLP profile ↗
ORCID search ↗
MIO: A Foundation Model on Multimodal Tokens
EMNLP 2025
·
Zekun Moore Wang
DBLP profile ↗
ORCID search ↗
MuPT: A Generative Symbolic Music Pretrained Transformer
ICLR 2025
·
Xingwei Qu
DBLP profile ↗
ORCID search ↗
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
ACL 2025
·
Siming Huang
DBLP profile ↗
ORCID search ↗
PopAlign: Diversifying Contrasting Patterns for a More Comprehensive Alignment
ACL 2025
·
Zekun Moore Wang
DBLP profile ↗
ORCID search ↗
T3D: Advancing 3D Medical Vision-Language Pre-Training by Learning Multi-View Visual Consistency
ICCV 2025
·
Che Liu
DBLP profile ↗
ORCID search ↗
Thinker: Learning to Think Fast and Slow
NeurIPS 2025
·
Stephen Chung
DBLP profile ↗
ORCID search ↗
VCR: A Task for Pixel-Level Complex Reasoning in Vision Language Models via Restoring Occluded Text
ICLR 2025
·
Tianyu Zhang
DBLP profile ↗
ORCID search ↗
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
ACL 2024
·
Jun Zhan
DBLP profile ↗
ORCID search ↗
AutoAgents: A Framework for Automatic Agent Generation
IJCAI 2024
·
Guangyao Chen
DBLP profile ↗
ORCID search ↗
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
ACL 2024
·
Yizhi Li
DBLP profile ↗
ORCID search ↗
Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs
ICLR 2024
·
Miao Xiong
DBLP profile ↗
ORCID search ↗
ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate
ICLR 2024
·
Chi-Min Chan
DBLP profile ↗
ORCID search ↗
ChatMusician: Understanding and Generating Music Intrinsically with LLM
ACL 2024
·
Ruibin Yuan
DBLP profile ↗
ORCID search ↗
D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
NeurIPS 2024
·
Haoran Que
DBLP profile ↗
ORCID search ↗
Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-Tuning
NAACL 2024
·
Shuai Zhao
DBLP profile ↗
ORCID search ↗
E2-LLM: Efficient and Extreme Length Extension of Large Language Models
ACL 2024
·
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
Empirical Study on Updating Key-Value Memories in Transformer Feed-forward Layers
ICLR 2024
·
Zihan Qiu
DBLP profile ↗
ORCID search ↗
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
ACL 2024
·
Hao Zhao
DBLP profile ↗
ORCID search ↗
MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training
ICLR 2024
·
Yizhi Li
DBLP profile ↗
ORCID search ↗
Massive Editing for Large Language Models via Meta Learning
ICLR 2024
·
Chenmien Tan
DBLP profile ↗
ORCID search ↗
OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement
ACL 2024
·
Tianyu Zheng
DBLP profile ↗
ORCID search ↗
PositionID: LLMs can Control Lengths, Copy and Paste with Explicit Positional Awareness
EMNLP 2024
·
Noah Wang
DBLP profile ↗
ORCID search ↗
ReForm-Eval: Evaluating Large Vision Language Models via Unified Re-Formulation of Task-Oriented Benchmarks
ACM MM 2024
·
Zejun Li
DBLP profile ↗
ORCID search ↗
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
ACL 2024
·
Noah Wang
DBLP profile ↗
ORCID search ↗
Scalable Geometric Fracture Assembly via Co-creation Space among Assemblers
AAAI 2024
·
Ruiyuan Zhang
DBLP profile ↗
ORCID search ↗
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
ACL 2024
·
Siwei Wu
DBLP profile ↗
ORCID search ↗
Stacking Your Transformers: A Closer Look at Model Growth for Efficient LLM Pre-Training
NeurIPS 2024
·
Wenyu Du
DBLP profile ↗
ORCID search ↗
Think Before You Act: Decision Transformers with Working Memory
ICML 2024
·
Jikun Kang
DBLP profile ↗
ORCID search ↗
UniIR: Training and Benchmarking Universal Multimodal Information Retrievers
ECCV 2024
·
Cong Wei
DBLP profile ↗
ORCID search ↗
Unlocking Continual Learning Abilities in Language Models
EMNLP 2024
·
Wenyu Du
DBLP profile ↗
ORCID search ↗
Unlocking Emergent Modularity in Large Language Models
NAACL 2024
·
Zihan Qiu
DBLP profile ↗
ORCID search ↗