P
PaperPicks
Conferences
Wenhai Wang
40 papers at tracked venues · 34 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
NeurIPS
×9
ACL
×6
CVPR
×5
AAAI
×4
ICLR
×4
ECCV
×3
ICML
×3
ICCV
×2
IJCAI
×2
NAACL
×1
WWW
×1
Frequent coauthors
Weiyun Wang
DBLP profile ↗
ORCID search ↗
×3
Yuchen Duan
DBLP profile ↗
ORCID search ↗
×2
Chenyu Yang
DBLP profile ↗
ORCID search ↗
×2
Tong Ye
DBLP profile ↗
ORCID search ↗
×2
Linglin Jing
DBLP profile ↗
ORCID search ↗
×1
Haonan Zhang
DBLP profile ↗
ORCID search ↗
×1
Xiangxiang Chen
DBLP profile ↗
ORCID search ↗
×1
Shuang Cheng
DBLP profile ↗
ORCID search ↗
×1
Shize Zhou
DBLP profile ↗
ORCID search ↗
×1
Xinyuan An
DBLP profile ↗
ORCID search ↗
×1
Ruifeng Luo
DBLP profile ↗
ORCID search ↗
×1
Junxian Li
DBLP profile ↗
ORCID search ↗
×1
Papers
EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
AAAI 2026
·
Linglin Jing
DBLP profile ↗
ORCID search ↗
LLM-VA: Resolving the Jailbreak-Overrefusal Trade-off via Vector Alignment
ACL 2026
·
Haonan Zhang
DBLP profile ↗
ORCID search ↗
LLMQuA: Practical Backdoor Injection on Large Language Model Quantization
WWW 2026
·
Xiangxiang Chen
DBLP profile ↗
ORCID search ↗
SDAR: A Synergistic Diffusion-AutoRegression Paradigm for Scalable Sequence Generation
ACL 2026
·
Shuang Cheng
DBLP profile ↗
ORCID search ↗
Selective Knowledge Distillation: Fusing LLM Semantic Strengths with DNN Efficiency for Binary Code Similarity Detection
ACL 2026
·
Shize Zhou
DBLP profile ↗
ORCID search ↗
Watch Out Your Industrial Copilots: Stealthy Backdoor Attack Against LLM-Based PLC Code Generation
ACL 2026
·
Xinyuan An
DBLP profile ↗
ORCID search ↗
ArchCAD-400K: A Large-Scale CAD drawings Dataset and New Baseline for Panoptic Symbol Spotting
NeurIPS 2025
·
Ruifeng Luo
DBLP profile ↗
ORCID search ↗
ChemVLM: Exploring the Power of Multimodal Large Language Models in Chemistry Area
AAAI 2025
·
Junxian Li
DBLP profile ↗
ORCID search ↗
CoMemo: LVLMs Need Image Context with Image Memory
ICML 2025
·
Shi Liu
DBLP profile ↗
ORCID search ↗
Diffuse&Refine: Intrinsic Knowledge Generation and Aggregation for Incremental Object Detection
IJCAI 2025
·
Jianzhou Wang
DBLP profile ↗
ORCID search ↗
Docopilot: Improving Multimodal Models for Document-Level Understanding
CVPR 2025
·
Yuchen Duan
DBLP profile ↗
ORCID search ↗
HoVLE: Unleashing the Power of Monolithic Vision-Language Models with Holistic Vision-Language Embedding
CVPR 2025
·
Chenxin Tao
DBLP profile ↗
ORCID search ↗
Lumina-Image 2.0: a Unified and Efficient Image Generative Framework
ICCV 2025
·
Qi Qin
DBLP profile ↗
ORCID search ↗
MuLan: Adapting Multilingual Diffusion Models for Hundreds of Languages with Negligible Cost
ICML 2025
·
Sen Xing
DBLP profile ↗
ORCID search ↗
NaViL: Rethinking Scaling Properties of Native Multimodal Large Language Models under Data Constraints
NeurIPS 2025
·
Changyao Tian
DBLP profile ↗
ORCID search ↗
OPMapper: Enhancing Open-Vocabulary Semantic Segmentation with Multi-Guidance Information
NeurIPS 2025
·
Xuehui Wang
DBLP profile ↗
ORCID search ↗
OWMM-Agent: Open World Mobile Manipulation With Multi-modal Agentic Data Synthesis
NeurIPS 2025
·
Junting Chen
DBLP profile ↗
ORCID search ↗
OmniAlign-V: Towards Enhanced Alignment of MLLMs with Human Preference
ACL 2025
·
Xiangyu Zhao
DBLP profile ↗
ORCID search ↗
OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
ICLR 2025
·
Qingyun Li
DBLP profile ↗
ORCID search ↗
PVC: Progressive Visual Token Compression for Unified Image and Video Processing in Large Vision-Language Models
CVPR 2025
·
Chenyu Yang
DBLP profile ↗
ORCID search ↗
Point or Line? Using Line-based Representation for Panoptic Symbol Spotting in CAD Drawings
NeurIPS 2025
·
Xingguang Wei
DBLP profile ↗
ORCID search ↗
Sticking to the Mean: Detecting Sticky Tokens in Text Embedding Models
ACL 2025
·
Kexin Chen
DBLP profile ↗
ORCID search ↗
UltraModel: A Modeling Paradigm for Industrial Objects
IJCAI 2025
·
Haoran Yang
DBLP profile ↗
ORCID search ↗
Unbiased Region-Language Alignment for Open-Vocabulary Dense Prediction
ICCV 2025
·
Yunheng Li
DBLP profile ↗
ORCID search ↗
Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code Rewriting
AAAI 2025
·
Tong Ye
DBLP profile ↗
ORCID search ↗
Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
ICLR 2025
·
Yuchen Duan
DBLP profile ↗
ORCID search ↗
AVSegFormer: Audio-Visual Segmentation with Transformer
AAAI 2024
·
Shengyi Gao
DBLP profile ↗
ORCID search ↗
Bounding Box Stability against Feature Dropout Reflects Detector Generalization across Environments
ICLR 2024
·
Yang Yang
DBLP profile ↗
ORCID search ↗
ControlLLM: Augment Language Models with Tools by Searching on Graphs
ECCV 2024
·
Zhaoyang Liu
DBLP profile ↗
ORCID search ↗
Distilling Knowledge from Large-Scale Image Models for Object Detection
ECCV 2024
·
Gang Li
DBLP profile ↗
ORCID search ↗
Efficient Deformable ConvNets: Rethinking Dynamic and Sparse Operator for Vision Applications
CVPR 2024
·
Yuwen Xiong
DBLP profile ↗
ORCID search ↗
Intern VL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks
CVPR 2024
·
Zhe Chen
DBLP profile ↗
ORCID search ↗
InternLM-XComposer2-4KHD: A Pioneering Large Vision-Language Model Handling Resolutions from 336 Pixels to 4K HD
NeurIPS 2024
·
Xiaoyi Dong
DBLP profile ↗
ORCID search ↗
Needle In A Multimodal Haystack
NeurIPS 2024
·
Weiyun Wang
DBLP profile ↗
ORCID search ↗
RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis
ICML 2024
·
Yao Mu
DBLP profile ↗
ORCID search ↗
The All-Seeing Project V2: Towards General Relation Comprehension of the Open World
ECCV 2024
·
Weiyun Wang
DBLP profile ↗
ORCID search ↗
The All-Seeing Project: Towards Panoptic Visual Recognition and Understanding of the Open World
ICLR 2024
·
Weiyun Wang
DBLP profile ↗
ORCID search ↗
Tram: A Token-level Retrieval-augmented Mechanism for Source Code Summarization
NAACL 2024
·
Tong Ye
DBLP profile ↗
ORCID search ↗
Vision Model Pre-training on Interleaved Image-Text Data via Latent Compression Learning
NeurIPS 2024
·
Chenyu Yang
DBLP profile ↗
ORCID search ↗
VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks
NeurIPS 2024
·
Jiannan Wu
DBLP profile ↗
ORCID search ↗