P
PaperPicks
Conferences
Peng Jin
15 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×4
ECCV
×3
EMNLP
×2
ICML
×2
ACL
×1
CVPR
×1
ICCV
×1
ICLR
×1
Frequent coauthors
Zesen Cheng
DBLP profile ↗
ORCID search ↗
×2
Yatian Pang
DBLP profile ↗
ORCID search ↗
×1
Guowei Xu
DBLP profile ↗
ORCID search ↗
×1
Haoran Tang
DBLP profile ↗
ORCID search ↗
×1
Zhiyuan Yan
DBLP profile ↗
ORCID search ↗
×1
Hao Li
DBLP profile ↗
ORCID search ↗
×1
Zhongwei Wan
DBLP profile ↗
ORCID search ↗
×1
Meng Cao
DBLP profile ↗
ORCID search ↗
×1
Junwu Zhang
DBLP profile ↗
ORCID search ↗
×1
Bin Lin
DBLP profile ↗
ORCID search ↗
×1
Papers
Next Patch Prediction for AutoRegressive Visual Generation
AAAI 2026
·
Yatian Pang
DBLP profile ↗
ORCID search ↗
Aligning Instance Brownian Bridge with Texts for Open-Vocabulary Video Instance Segmentation
AAAI 2025
·
Zesen Cheng
DBLP profile ↗
ORCID search ↗
LlaVA-CoT: Let Vision Language Models Reason Step-By-Step
ICCV 2025
·
Guowei Xu
DBLP profile ↗
ORCID search ↗
MUSE: Mamba Is Efficient Multi-scale Learner for Text-video Retrieval
AAAI 2025
·
Haoran Tang
DBLP profile ↗
ORCID search ↗
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
ICLR 2025
·
Peng Jin
MoH: Multi-Head Attention as Mixture-of-Head Attention
ICML 2025
·
Peng Jin
Orthogonal Subspace Decomposition for Generalizable AI-Generated Image Detection
ICML 2025
·
Zhiyuan Yan
DBLP profile ↗
ORCID search ↗
Chat-UniVi: Unified Visual Representation Empowers Large Language Models with Image and Video Understanding
CVPR 2024
·
Peng Jin
FreestyleRet: Retrieving Images from Style-Diversified Queries
ECCV 2024
·
Hao Li
DBLP profile ↗
ORCID search ↗
LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference
EMNLP 2024
·
Zhongwei Wan
DBLP profile ↗
ORCID search ↗
Local Action-Guided Motion Diffusion Model for Text-to-Motion Generation
ECCV 2024
·
Peng Jin
Parallel Vertex Diffusion for Unified Visual Grounding
AAAI 2024
·
Zesen Cheng
DBLP profile ↗
ORCID search ↗
RAP: Efficient Text-Video Retrieval with Sparse-and-Correlated Adapter
ACL 2024
·
Meng Cao
DBLP profile ↗
ORCID search ↗
Repaint123: Fast and High-Quality One Image to 3D Generation with Progressive Controllable Repainting
ECCV 2024
·
Junwu Zhang
DBLP profile ↗
ORCID search ↗
Video-LLaVA: Learning United Visual Representation by Alignment Before Projection
EMNLP 2024
·
Bin Lin
DBLP profile ↗
ORCID search ↗