P
PaperPicks
Conferences
Kaipeng Zhang
41 papers at tracked venues · 38 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
NeurIPS
×9
ACL
×6
ICLR
×6
ICCV
×5
ICML
×5
AAAI
×3
CVPR
×3
EMNLP
×1
IJCAI
×1
NAACL
×1
WWW
×1
Frequent coauthors
Pengfei Zhou
DBLP profile ↗
ORCID search ↗
×3
Fanqing Meng
DBLP profile ↗
ORCID search ↗
×3
Yefei He
DBLP profile ↗
ORCID search ↗
×3
Zizhen Li
DBLP profile ↗
ORCID search ↗
×2
Yue Yang
DBLP profile ↗
ORCID search ↗
×2
Yuqi Lin
DBLP profile ↗
ORCID search ↗
×2
Wenshuo Peng
DBLP profile ↗
ORCID search ↗
×2
Yukang Feng
DBLP profile ↗
ORCID search ↗
×1
Fanrui Zhang
DBLP profile ↗
ORCID search ↗
×1
Kang He
DBLP profile ↗
ORCID search ↗
×1
Mengzhao Chen
DBLP profile ↗
ORCID search ↗
×1
Quanfeng Lu
DBLP profile ↗
ORCID search ↗
×1
Papers
LongCLI-Bench: A Preliminary Benchmark and Study for Long-horizon Agentic Programming in Command-Line Interfaces
ACL 2026
·
Yukang Feng
DBLP profile ↗
ORCID search ↗
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
AAAI 2026
·
Pengfei Zhou
DBLP profile ↗
ORCID search ↗
MeepleLM: A Virtual Playtester Simulating Diverse Subjective Experiences
ACL 2026
·
Zizhen Li
DBLP profile ↗
ORCID search ↗
Navigating Truth in Multimodal Fact-checking via Retrieval- and Reasoning-Enhanced Large Language Models
WWW 2026
·
Fanrui Zhang
DBLP profile ↗
ORCID search ↗
Uncertainty-Calibrated Elastic Alignment for Multimodal Sentiment Analysis with Missing Modalities
ACL 2026
·
Kang He
DBLP profile ↗
ORCID search ↗
Dynamic Multimodal Evaluation with Flexible Complexity by Vision-Language Bootstrapping
ICLR 2025
·
Yue Yang
DBLP profile ↗
ORCID search ↗
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
ACL 2025
·
Mengzhao Chen
DBLP profile ↗
ORCID search ↗
GUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices
ICCV 2025
·
Quanfeng Lu
DBLP profile ↗
ORCID search ↗
InMind: Evaluating LLMs in Capturing and Applying Individual Human Reasoning Styles
EMNLP 2025
·
Zizhen Li
DBLP profile ↗
ORCID search ↗
LiT: Delving into a Simple Linear Diffusion Transformer for Image Generation
ICCV 2025
·
Jiahao Wang
DBLP profile ↗
ORCID search ↗
MMIU: Multimodal Multi-image Understanding for Evaluating Large Vision-Language Models
ICLR 2025
·
Fanqing Meng
DBLP profile ↗
ORCID search ↗
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
ACL 2025
·
Xu Zhao Pan
DBLP profile ↗
ORCID search ↗
Neighboring Autoregressive Modeling for Efficient Visual Generation
ICCV 2025
·
Yefei He
DBLP profile ↗
ORCID search ↗
Neural-Driven Image Editing
NeurIPS 2025
·
Pengfei Zhou
DBLP profile ↗
ORCID search ↗
OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation
CVPR 2025
·
Pengfei Zhou
DBLP profile ↗
ORCID search ↗
ProJudge: A Multi-Modal Multi-Discipline Benchmark and Instruction-Tuning Dataset for Mllm-Based Process Judges
ICCV 2025
·
Jiaxin Ai
DBLP profile ↗
ORCID search ↗
REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
NeurIPS 2025
·
Ziqiao Wang
DBLP profile ↗
ORCID search ↗
SAMRefiner: Taming Segment Anything Model for Universal Mask Refinement
ICLR 2025
·
Yuqi Lin
DBLP profile ↗
ORCID search ↗
Sekai: A Video Dataset towards World Exploration
NeurIPS 2025
·
Zhen Li
DBLP profile ↗
ORCID search ↗
TP-Eval: Tap Multimodal LLMs' Potential in Evaluation by Customizing Prompts
IJCAI 2025
·
Yuxuan Xie
DBLP profile ↗
ORCID search ↗
To Think or Not To Think: A Study of Thinking in Rule-Based Visual Reinforcement Fine-Tuning
NeurIPS 2025
·
Ming Li
DBLP profile ↗
ORCID search ↗
Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation
ICML 2025
·
Fanqing Meng
DBLP profile ↗
ORCID search ↗
ZipAR: Parallel Autoregressive Image Generation through Spatial Locality
ICML 2025
·
Yefei He
DBLP profile ↗
ORCID search ↗
ZipVL: Accelerating Vision-Language Models Through Dynamic Token Sparsity
ICCV 2025
·
Yefei He
DBLP profile ↗
ORCID search ↗
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
ICLR 2024
·
Peng Xu
DBLP profile ↗
ORCID search ↗
ChartAssistant: A Universal Chart Multimodal Language Model via Chart-to-Table Pre-training and Multitask Instruction Tuning
ACL 2024
·
Fanqing Meng
DBLP profile ↗
ORCID search ↗
ConvBench: A Multi-Turn Conversation Evaluation Benchmark with Hierarchical Ablation Capability for Large Vision-Language Models
NeurIPS 2024
·
Shuo Liu
DBLP profile ↗
ORCID search ↗
Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification
AAAI 2024
·
Wenshuo Peng
DBLP profile ↗
ORCID search ↗
DiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model
CVPR 2024
·
Lirui Zhao
DBLP profile ↗
ORCID search ↗
Lumina-Next : Making Lumina-T2X Stronger and Faster with Next-DiT
NeurIPS 2024
·
Le Zhuo
DBLP profile ↗
ORCID search ↗
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
ICML 2024
·
Kaining Ying
DBLP profile ↗
ORCID search ↗
Needle In A Multimodal Haystack
NeurIPS 2024
·
Weiyun Wang
DBLP profile ↗
ORCID search ↗
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
ICLR 2024
·
Wenqi Shao
DBLP profile ↗
ORCID search ↗
OneLLM: One Framework to Align All Modalities with Language
CVPR 2024
·
Jiaming Han
DBLP profile ↗
ORCID search ↗
Position: Towards Implicit Prompt For Text-To-Image Models
ICML 2024
·
Yue Yang
DBLP profile ↗
ORCID search ↗
Rethinking Human Evaluation Protocol for Text-to-Video Models: Enhancing Reliability, Reproducibility, and Practicality
NeurIPS 2024
·
Tianle Zhang
DBLP profile ↗
ORCID search ↗
SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models
ICML 2024
·
Dongyang Liu
DBLP profile ↗
ORCID search ↗
SearchLVLMs: A Plug-and-Play Framework for Augmenting Large Vision-Language Models by Searching Up-to-Date Internet Knowledge
NeurIPS 2024
·
Chuanhao Li
DBLP profile ↗
ORCID search ↗
T3M: Text Guided 3D Human Motion Synthesis from Speech
NAACL 2024
·
Wenshuo Peng
DBLP profile ↗
ORCID search ↗
TagCLIP: A Local-to-Global Framework to Enhance Open-Vocabulary Multi-Label Classification of CLIP without Training
AAAI 2024
·
Yuqi Lin
DBLP profile ↗
ORCID search ↗
Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching
ICLR 2024
·
Ziyao Guo
DBLP profile ↗
ORCID search ↗