P
PaperPicks
Conferences
Jiayi Ji
36 papers at tracked venues · 33 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×9
NeurIPS
×8
CVPR
×4
ICML
×4
ACM MM
×3
ECCV
×3
ICCV
×2
ICLR
×2
ACL
×1
Frequent coauthors
Zhipeng Qian
DBLP profile ↗
ORCID search ↗
×3
Changli Wu
DBLP profile ↗
ORCID search ↗
×3
Mingrui Wu
DBLP profile ↗
ORCID search ↗
×3
Qi Chen
DBLP profile ↗
ORCID search ↗
×2
Yongdong Luo
DBLP profile ↗
ORCID search ↗
×2
Yingying Feng
DBLP profile ↗
ORCID search ↗
×2
Yaxin Luo
DBLP profile ↗
ORCID search ↗
×2
Danni Yang
DBLP profile ↗
ORCID search ↗
×2
Yiwei Ma
DBLP profile ↗
ORCID search ↗
×2
Jie Li
DBLP profile ↗
ORCID search ↗
×1
Lvpan Cai
DBLP profile ↗
ORCID search ↗
×1
Yubin Gu
DBLP profile ↗
ORCID search ↗
×1
Papers
3D-DRES: Detailed 3D Referring Expression Segmentation
AAAI 2026
·
Qi Chen
DBLP profile ↗
ORCID search ↗
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
ACL 2026
·
Zhipeng Qian
DBLP profile ↗
ORCID search ↗
FIND: A Simple Yet Effective Baseline for Diffusion-Generated Image Detection
AAAI 2026
·
Jie Li
DBLP profile ↗
ORCID search ↗
QuoTA: Query-oriented Token Assignment via CoT Query Decouple for Long Video Comprehension
AAAI 2026
·
Yongdong Luo
DBLP profile ↗
ORCID search ↗
Zooming In on Fakes: A Novel Dataset for Localized AI-Generated Image Detection with Forgery Amplification Approach
AAAI 2026
·
Lvpan Cai
DBLP profile ↗
ORCID search ↗
ACL: Activating Capability of Linear Attention for Image Restoration
CVPR 2025
·
Yubin Gu
DBLP profile ↗
ORCID search ↗
Aigi-Holmes: Towards Explainable and Generalizable AI-Generated Image Detection via Multimodal Large Language Models
ICCV 2025
·
Ziyin Zhou
DBLP profile ↗
ORCID search ↗
DViN: Dynamic Visual Routing Network for Weakly Supervised Referring Expression Comprehension
CVPR 2025
·
Xiaofu Chen
DBLP profile ↗
ORCID search ↗
GSAlign: Geometric and Semantic Alignment Network for Aerial-Ground Person Re-Identification
NeurIPS 2025
·
Qiao Li
DBLP profile ↗
ORCID search ↗
HRSeg: High-Resolution Visual Perception and Enhancement for Reasoning Segmentation
ACM MM 2025
·
Weihuang Lin
DBLP profile ↗
ORCID search ↗
IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression Segmentation
AAAI 2025
·
Qi Chen
DBLP profile ↗
ORCID search ↗
Inter2Former: Dynamic Hybrid Attention for Efficient High-Precision Interactive Segmentation
ICCV 2025
·
You Huang
DBLP profile ↗
ORCID search ↗
JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation
NeurIPS 2025
·
Kai Liu
DBLP profile ↗
ORCID search ↗
MDReID: Modality-Decoupled Learning for Any-to-Any Multi-Modal Object Re-Identification
NeurIPS 2025
·
Yingying Feng
DBLP profile ↗
ORCID search ↗
MIHBench: Benchmarking and Mitigating Multi-Image Hallucinations in Multimodal Large Language Models
ACM MM 2025
·
Jiale Li
DBLP profile ↗
ORCID search ↗
Multi-Modal Object Re-identification via Sparse Mixture-of-Experts
ICML 2025
·
Yingying Feng
DBLP profile ↗
ORCID search ↗
Towards General Visual-Linguistic Face Forgery Detection
CVPR 2025
·
Ke Sun
DBLP profile ↗
ORCID search ↗
Towards Semantic Equivalence of Tokenization in Multimodal LLM
ICLR 2025
·
Shengqiong Wu
DBLP profile ↗
ORCID search ↗
Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension
NeurIPS 2025
·
Yongdong Luo
DBLP profile ↗
ORCID search ↗
γ-MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models
ICLR 2025
·
Yaxin Luo
DBLP profile ↗
ORCID search ↗
3D-GRES: Generalized 3D Referring Expression Segmentation
ACM MM 2024
·
Changli Wu
DBLP profile ↗
ORCID search ↗
3D-STMN: Dependency-Driven Superpoint-Text Matching Network for End-to-End 3D Referring Expression Segmentation
AAAI 2024
·
Changli Wu
DBLP profile ↗
ORCID search ↗
APL: Anchor-Based Prompt Learning for One-Stage Weakly Supervised Referring Expression Comprehension
ECCV 2024
·
Yaxin Luo
DBLP profile ↗
ORCID search ↗
ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models
NeurIPS 2024
·
Mingrui Wu
DBLP profile ↗
ORCID search ↗
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
ICML 2024
·
Mingrui Wu
DBLP profile ↗
ORCID search ↗
Exploring Phrase-Level Grounding with Text-to-Image Diffusion Model
ECCV 2024
·
Danni Yang
DBLP profile ↗
ORCID search ↗
I2EBench: A Comprehensive Benchmark for Instruction-based Image Editing
NeurIPS 2024
·
Yiwei Ma
DBLP profile ↗
ORCID search ↗
Improving Panoptic Narrative Grounding by Harnessing Semantic Relationships and Visual Confirmation
AAAI 2024
·
Tianyu Guo
DBLP profile ↗
ORCID search ↗
Multi-branch Collaborative Learning Network for 3D Visual Grounding
ECCV 2024
·
Zhipeng Qian
DBLP profile ↗
ORCID search ↗
RG-SAN: Rule-Guided Spatial Awareness Network for End-to-End 3D Referring Expression Segmentation
NeurIPS 2024
·
Changli Wu
DBLP profile ↗
ORCID search ↗
Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation
CVPR 2024
·
Sihan Liu
DBLP profile ↗
ORCID search ↗
SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation
ICML 2024
·
Danni Yang
DBLP profile ↗
ORCID search ↗
Synergistic Dual Spatial-aware Generation of Image-to-text and Text-to-image
NeurIPS 2024
·
Yu Zhao
DBLP profile ↗
ORCID search ↗
Toward Open-Set Human Object Interaction Detection
AAAI 2024
·
Mingrui Wu
DBLP profile ↗
ORCID search ↗
X-Oscar: A Progressive Framework for High-quality Text-guided 3D Animatable Avatar Generation
ICML 2024
·
Yiwei Ma
DBLP profile ↗
ORCID search ↗
X-RefSeg3D: Enhancing Referring 3D Instance Segmentation via Structured Cross-Modal Graph Neural Networks
AAAI 2024
·
Zhipeng Qian
DBLP profile ↗
ORCID search ↗