P
PaperPicks
Conferences
Ge Zhang
ByteDance Inc.
57 papers at tracked venues · 45 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0002-0064-2906 ↗
Google Scholar ↗
Homepage ↗
Venues
ACL
×18
NeurIPS
×11
ICLR
×10
EMNLP
×5
NAACL
×3
AAAI
×2
EACL
×2
ICCV
×2
CVPR
×1
ECCV
×1
IJCAI
×1
WWW
×1
Frequent coauthors
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
×4
Xiang Yue
DBLP profile ↗
ORCID search ↗
×4
Siwei Wu
DBLP profile ↗
ORCID search ↗
×3
Yizhi Li
DBLP profile ↗
ORCID search ↗
×3
Xianjie Wu
DBLP profile ↗
ORCID search ↗
×2
Cong Wei
DBLP profile ↗
ORCID search ↗
×2
Siyi Li
DBLP profile ↗
ORCID search ↗
×1
Zhongyuan Peng
DBLP profile ↗
ORCID search ↗
×1
Daixin Shu
DBLP profile ↗
ORCID search ↗
×1
Shukai Liu
DBLP profile ↗
ORCID search ↗
×1
Yuhang Zhou
DBLP profile ↗
ORCID search ↗
×1
Meng Cao
DBLP profile ↗
ORCID search ↗
×1
Papers
COIG-P: A High-Quality and Large-Scale Chinese Preference Dataset for Alignment with Human Values
EACL 2026
·
Siwei Wu
DBLP profile ↗
ORCID search ↗
CoTJudger: A Graph-Driven Framework for Automatic Evaluation of Chain-of-Thought Efficiency and Redundancy in LRMs
ACL 2026
·
Siyi Li
DBLP profile ↗
ORCID search ↗
CriticLean: Critic-Guided Reinforcement Learning for Mathematical Formalization
ACL 2026
·
Zhongyuan Peng
DBLP profile ↗
ORCID search ↗
M3TQA: Massively Multilingual Multitask Table Question Answering
ACL 2026
·
Daixin Shu
DBLP profile ↗
ORCID search ↗
MMRA: A Benchmark for Evaluating Multi-Granularity and Multi-Image Relational Association Capabilities in Large Visual Language Models
EACL 2026
·
Siwei Wu
DBLP profile ↗
ORCID search ↗
MMTableBench: A Multi-level Multimodal Benchmark for Reasoning and Layout Complexity in Table QA
WWW 2026
·
Xianjie Wu
DBLP profile ↗
ORCID search ↗
MdEval: Massively Multilingual Code Debugging
ACL 2026
·
Shukai Liu
DBLP profile ↗
ORCID search ↗
PRISM: Probabilistic Reward Model with Inherent Structural Modeling
ACL 2026
·
Yuhang Zhou
DBLP profile ↗
ORCID search ↗
Video SimpleQA: Towards Factuality Evaluation in Large Video Language Models
AAAI 2026
·
Meng Cao
DBLP profile ↗
ORCID search ↗
CLaMP 2: Multimodal Music Information Retrieval Across 101 Languages Using Large Language Models
NAACL 2025
·
Shangda Wu
DBLP profile ↗
ORCID search ↗
COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning
NAACL 2025
·
Yuelin Bai
DBLP profile ↗
ORCID search ↗
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
ACL 2025
·
Yancheng He
DBLP profile ↗
ORCID search ↗
Can MLLMs Understand the Deep Implication Behind Chinese Images?
ACL 2025
·
Chenhao Zhang
DBLP profile ↗
ORCID search ↗
FlexWorld: Progressively Expanding 3D Scenes for Flexible-View Exploration
NeurIPS 2025
·
Luxi Chen
DBLP profile ↗
ORCID search ↗
General-Reasoner: Advancing LLM Reasoning Across All Domains
NeurIPS 2025
·
Xueguang Ma
DBLP profile ↗
ORCID search ↗
KARPA: A Training-free Method of Adapting Knowledge Graph as References for Large Language Model's Reasoning Path Aggregation
ACL 2025
·
Siyuan Fang
DBLP profile ↗
ORCID search ↗
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
ICLR 2025
·
Kaijing Ma
DBLP profile ↗
ORCID search ↗
KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation
NeurIPS 2025
·
Jiajun Shi
DBLP profile ↗
ORCID search ↗
LIME: Less Is More for MLLM Evaluation
ACL 2025
·
King Zhu
DBLP profile ↗
ORCID search ↗
M2RC-EVAL: Massively Multilingual Repository-level Code Completion Evaluation
ACL 2025
·
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
MARS-Bench: A Multi-turn Athletic Real-world Scenario Benchmark for Dialogue Evaluation
EMNLP 2025
·
Chenghao Yang
DBLP profile ↗
ORCID search ↗
MIO: A Foundation Model on Multimodal Tokens
EMNLP 2025
·
Zekun Moore Wang
DBLP profile ↗
ORCID search ↗
MMMU-Pro: A More Robust Multi-discipline Multimodal Understanding Benchmark
ACL 2025
·
Xiang Yue
DBLP profile ↗
ORCID search ↗
MTU-Bench: A Multi-granularity Tool-Use Benchmark for Large Language Models
ICLR 2025
·
Pei Wang
DBLP profile ↗
ORCID search ↗
MVU-Eval: Towards Multi-Video Understanding Evaluation for Multimodal LLMs
NeurIPS 2025
·
Tianhao Peng
DBLP profile ↗
ORCID search ↗
McEval: Massively Multilingual Code Evaluation
ICLR 2025
·
Linzheng Chai
DBLP profile ↗
ORCID search ↗
MuPT: A Generative Symbolic Music Pretrained Transformer
ICLR 2025
·
Xingwei Qu
DBLP profile ↗
ORCID search ↗
OAgents: An Empirical Study of Building Effective Agents
EMNLP 2025
·
He Zhu
DBLP profile ↗
ORCID search ↗
Omni-MATH: A Universal Olympiad Level Mathematic Benchmark for Large Language Models
ICLR 2025
·
Bofei Gao
DBLP profile ↗
ORCID search ↗
OmniBench: Towards The Future of Universal Omni-Language Models
NeurIPS 2025
·
Yizhi Li
DBLP profile ↗
ORCID search ↗
OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
ICLR 2025
·
Cong Wei
DBLP profile ↗
ORCID search ↗
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
ACL 2025
·
Siming Huang
DBLP profile ↗
ORCID search ↗
SimpleVQA: Multimodal Factuality Evaluation for Multimodal Large Language Models
ICCV 2025
·
Xianfu Cheng
DBLP profile ↗
ORCID search ↗
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
AAAI 2025
·
Xianjie Wu
DBLP profile ↗
ORCID search ↗
VAMBA: Understanding Hour-Long Videos with Hybrid Mamba-Transformers
ICCV 2025
·
Weiming Ren
DBLP profile ↗
ORCID search ↗
VCR: A Task for Pixel-Level Complex Reasoning in Vision Language Models via Restoring Occluded Text
ICLR 2025
·
Tianyu Zhang
DBLP profile ↗
ORCID search ↗
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
ACL 2024
·
Jun Zhan
DBLP profile ↗
ORCID search ↗
AutoAgents: A Framework for Automatic Agent Generation
IJCAI 2024
·
Guangyao Chen
DBLP profile ↗
ORCID search ↗
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
ACL 2024
·
Yizhi Li
DBLP profile ↗
ORCID search ↗
ChatMusician: Understanding and Generating Music Intrinsically with LLM
ACL 2024
·
Ruibin Yuan
DBLP profile ↗
ORCID search ↗
D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models
NeurIPS 2024
·
Haoran Que
DBLP profile ↗
ORCID search ↗
DDK: Distilling Domain Knowledge for Efficient Large Language Models
NeurIPS 2024
·
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
E2-LLM: Efficient and Extreme Length Extension of Large Language Models
ACL 2024
·
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
NeurIPS 2024
·
Ziqiang Liu
DBLP profile ↗
ORCID search ↗
MAmmoTH2: Scaling Instructions from the Web
NeurIPS 2024
·
Xiang Yue
DBLP profile ↗
ORCID search ↗
MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning
ICLR 2024
·
Xiang Yue
DBLP profile ↗
ORCID search ↗
MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training
ICLR 2024
·
Yizhi Li
DBLP profile ↗
ORCID search ↗
MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark
NeurIPS 2024
·
Yubo Wang
DBLP profile ↗
ORCID search ↗
MMMU: A Massive Multi-Discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI
CVPR 2024
·
Xiang Yue
DBLP profile ↗
ORCID search ↗
MMTE: Corpus and Metrics for Evaluating Machine Translation Quality of Metaphorical Language
EMNLP 2024
·
Shun Wang
DBLP profile ↗
ORCID search ↗
Massive Editing for Large Language Models via Meta Learning
ICLR 2024
·
Chenmien Tan
DBLP profile ↗
ORCID search ↗
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
NAACL 2024
·
Zihao Deng
DBLP profile ↗
ORCID search ↗
OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement
ACL 2024
·
Tianyu Zheng
DBLP profile ↗
ORCID search ↗
RoleAgent: Building, Interacting, and Benchmarking High-quality Role-Playing Agents from Scripts
NeurIPS 2024
·
Jiaheng Liu
DBLP profile ↗
ORCID search ↗
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
ACL 2024
·
Siwei Wu
DBLP profile ↗
ORCID search ↗
UniIR: Training and Benchmarking Universal Multimodal Information Retrievers
ECCV 2024
·
Cong Wei
DBLP profile ↗
ORCID search ↗
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation
EMNLP 2024
·
Xuan He
DBLP profile ↗
ORCID search ↗