P
PaperPicks
Conferences
Yu Zhou
Nankai University, Tianjin, China
28 papers at tracked venues · 20 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-4188-9953 ↗
Homepage ↗
Venues
AAAI
×9
ACM MM
×5
ICDAR
×4
ECAI
×2
ICML
×2
IJCAI
×2
NeurIPS
×2
CVPR
×1
ICCV
×1
Frequent coauthors
Daiqing Wu
DBLP profile ↗
ORCID search ↗
×3
Qilang Ye
DBLP profile ↗
ORCID search ↗
×2
Tianjiao Cao
DBLP profile ↗
ORCID search ↗
×2
Aoting Zhang
DBLP profile ↗
ORCID search ↗
×2
Yan Zhang
DBLP profile ↗
ORCID search ↗
×2
Zeng Li
DBLP profile ↗
ORCID search ↗
×2
Fangmin Zhao
DBLP profile ↗
ORCID search ↗
×2
Jin Wei
DBLP profile ↗
ORCID search ↗
×1
Lian He
DBLP profile ↗
ORCID search ↗
×1
Jiahao Lyu
DBLP profile ↗
ORCID search ↗
×1
Gengluo Li
DBLP profile ↗
ORCID search ↗
×1
Minxing Luo
DBLP profile ↗
ORCID search ↗
×1
Papers
ST-SAM: Multimodal Scene Text Segmentation with Dense Visual and Sparse Textual Prompts via SAM
AAAI 2026
·
Jin Wei
DBLP profile ↗
ORCID search ↗
SUGAR: Learning Skeleton Representation with Visual-Motion Knowledge for Action Recognition
AAAI 2026
·
Qilang Ye
DBLP profile ↗
ORCID search ↗
Task-Aware 3D Affordance Segmentation via 2D Guidance and Geometric Refinement
AAAI 2026
·
Lian He
DBLP profile ↗
ORCID search ↗
Towards Breaking the Visual Perception Bottleneck for Geometry Problem Solving
ICDAR 2026
·
Tianjiao Cao
DBLP profile ↗
ORCID search ↗
When Eyes and Ears Disagree: Can MLLMs Discern Audio-Visual Confusion?
AAAI 2026
·
Qilang Ye
DBLP profile ↗
ORCID search ↗
An Empirical Study on Configuring In-Context Learning Demonstrations for Unleashing MLLMs' Sentimental Perception Capability
ICML 2025
·
Daiqing Wu
DBLP profile ↗
ORCID search ↗
Arbitrary Reading Order Scene Text Spotter with Local Semantics Guidance
AAAI 2025
·
Jiahao Lyu
DBLP profile ↗
ORCID search ↗
Beyond Cropped Regions: New Benchmark and Corresponding Baseline for Chinese Scene Text Retrieval in Diverse Layouts
ICML 2025
·
Gengluo Li
DBLP profile ↗
ORCID search ↗
Beyond Flat Text: Dual Self-Inherited Guidance for Visual Text Generation
ICCV 2025
·
Minxing Luo
DBLP profile ↗
ORCID search ↗
Class-Agnostic Region-of-Interest Matching in Document Images
ICDAR 2025
·
Demin Zhang
DBLP profile ↗
ORCID search ↗
DCA: Dividing and Conquering Amnesia in Incremental Object Detection
AAAI 2025
·
Aoting Zhang
DBLP profile ↗
ORCID search ↗
Gather and Trace: Rethinking Video TextVQA from an Instance-oriented Perspective
ACM MM 2025
·
Yan Zhang
DBLP profile ↗
ORCID search ↗
LDP: Generalizing to Multilingual Visual Information Extraction by Language Decoupled Pretraining
AAAI 2025
·
Huawen Shen
DBLP profile ↗
ORCID search ↗
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
CVPR 2025
·
Yifei Zhang
DBLP profile ↗
ORCID search ↗
PACM: Position-Aware Cross-Modality Decoder for Handwritten Mathematical Expression Recognition
ICDAR 2025
·
Zeng Li
DBLP profile ↗
ORCID search ↗
PerturbCTC: Improving Alignment in Scene Text Recognition with Feature Perturbation Based CTC
ICDAR 2025
·
Zeng Li
DBLP profile ↗
ORCID search ↗
Specifying What You Know or Not for Multi-Label Class-Incremental Learning
AAAI 2025
·
Aoting Zhang
DBLP profile ↗
ORCID search ↗
TADoc: Robust Time-Aware Document Image Dewarping
ECAI 2025
·
Fangmin Zhao
DBLP profile ↗
ORCID search ↗
The Devil is in Fine-tuning and Long-tailed Problems: A New Benchmark for Scene Text Detection
IJCAI 2025
·
Tianjiao Cao
DBLP profile ↗
ORCID search ↗
The Role of Video Generation in Enhancing Data-Limited Action Understanding
IJCAI 2025
·
Wei Li
DBLP profile ↗
ORCID search ↗
Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal Clues
AAAI 2025
·
Yan Zhang
DBLP profile ↗
ORCID search ↗
Uni-DocDiff: A Unified Document Restoration Model Based on Diffusion
ACM MM 2025
·
Fangmin Zhao
DBLP profile ↗
ORCID search ↗
When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding
NeurIPS 2025
·
Yan Shu
DBLP profile ↗
ORCID search ↗
Bridging Visual Affective Gap: Borrowing Textual Knowledge by Learning from Noisy Image-Text Pairs
ACM MM 2024
·
Daiqing Wu
DBLP profile ↗
ORCID search ↗
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
ECAI 2024
·
Zhenhang Li
DBLP profile ↗
ORCID search ↗
Focus, Distinguish, and Prompt: Unleashing CLIP for Efficient and Flexible Scene Text Retrieval
ACM MM 2024
·
Gangyan Zeng
DBLP profile ↗
ORCID search ↗
Robust Multimodal Sentiment Analysis of Image-Text Pairs by Distribution-Based Feature Recovery and Fusion
ACM MM 2024
·
Daiqing Wu
DBLP profile ↗
ORCID search ↗
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
NeurIPS 2024
·
Weichao Zeng
DBLP profile ↗
ORCID search ↗