P
PaperPicks
Conferences
Jing Shi
14 papers at tracked venues · 12 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
CVPR
×4
AAAI
×2
ACL
×2
ECCV
×2
ICCV
×2
ACM MM
×1
ICML
×1
Frequent coauthors
Hang Hua
DBLP profile ↗
ORCID search ↗
×2
Kiymet Akdemir
DBLP profile ↗
ORCID search ↗
×1
Kai Wang
DBLP profile ↗
ORCID search ↗
×1
Zonglin Di
DBLP profile ↗
ORCID search ↗
×1
Dang Nguyen
DBLP profile ↗
ORCID search ↗
×1
Jefferson Hernandez
DBLP profile ↗
ORCID search ↗
×1
Savya Khosla
DBLP profile ↗
ORCID search ↗
×1
Daiqing Qi
DBLP profile ↗
ORCID search ↗
×1
Saehyung Lee
DBLP profile ↗
ORCID search ↗
×1
Jisu Nam
DBLP profile ↗
ORCID search ↗
×1
Thao Nguyen
DBLP profile ↗
ORCID search ↗
×1
Yixuan Ren
DBLP profile ↗
ORCID search ↗
×1
Papers
Plot'n Polish: Zero-Shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models
AAAI 2026
·
Kiymet Akdemir
DBLP profile ↗
ORCID search ↗
AV-DiT: Taming Image Diffusion Transformers for Efficient Joint Audio and Video Generation
ACM MM 2025
·
Kai Wang
DBLP profile ↗
ORCID search ↗
DiffTell: A High-Quality Dataset for Describing Image Manipulation Changes
ICCV 2025
·
Zonglin Di
DBLP profile ↗
ORCID search ↗
FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity
CVPR 2025
·
Hang Hua
DBLP profile ↗
ORCID search ↗
GUI Agents: A Survey
ACL 2025
·
Dang Nguyen
DBLP profile ↗
ORCID search ↗
Improving Large Vision and Language Models by Learning from a Panel of Peers
ICCV 2025
·
Jefferson Hernandez
DBLP profile ↗
ORCID search ↗
MAGNET: Augmenting Generative Decoders with Representation Learning and Infilling Capabilities
ACL 2025
·
Savya Khosla
DBLP profile ↗
ORCID search ↗
The Photographer's Eye: Teaching Multimodal Large Language Models to See, and Critique Like Photographers
CVPR 2025
·
Daiqing Qi
DBLP profile ↗
ORCID search ↗
Toward Robust Hyper-Detailed Image Captioning: A Multiagent Approach and Dual Evaluation Metrics for Factuality and Coverage
ICML 2025
·
Saehyung Lee
DBLP profile ↗
ORCID search ↗
Visual Persona: Foundation Model for Full-Body Human Customization
CVPR 2025
·
Jisu Nam
DBLP profile ↗
ORCID search ↗
Yo'Chameleon: Personalized Vision and Language Generation
CVPR 2025
·
Thao Nguyen
DBLP profile ↗
ORCID search ↗
Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models
ECCV 2024
·
Yixuan Ren
DBLP profile ↗
ORCID search ↗
FineMatch: Aspect-Based Fine-Grained Image and Text Mismatch Detection and Correction
ECCV 2024
·
Hang Hua
DBLP profile ↗
ORCID search ↗
VIXEN: Visual Text Comparison Network for Image Difference Captioning
AAAI 2024
·
Alexander Black
DBLP profile ↗
ORCID search ↗