P
PaperPicks
Conferences
Weidong Cai
University of Sydney, Australia
39 papers at tracked venues · 21 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID 0000-0003-3706-8896 ↗
Google Scholar ↗
Homepage ↗
Venues
AAAI
×6
ACM MM
×5
WACV
×5
CVPR
×4
MICCAI
×4
WWW
×3
ACL
×2
BMVC
×2
ECCV
×2
EMNLP
×2
ECAI
×1
ICCV
×1
ICRA
×1
IROS
×1
Frequent coauthors
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
×6
Shunqi Mao
DBLP profile ↗
ORCID search ↗
×2
Xuanchen Wang
DBLP profile ↗
ORCID search ↗
×2
Zhiyuan Li
DBLP profile ↗
ORCID search ↗
×2
Weijia Zhang
DBLP profile ↗
ORCID search ↗
×2
Runkai Zhao
DBLP profile ↗
ORCID search ↗
×2
Jianan Fan
DBLP profile ↗
ORCID search ↗
×2
Qinyi Cao
DBLP profile ↗
ORCID search ↗
×1
Yaxuan Song
DBLP profile ↗
ORCID search ↗
×1
Wei Guo
DBLP profile ↗
ORCID search ↗
×1
Ziqiao Weng
DBLP profile ↗
ORCID search ↗
×1
Mingyu Sheng
DBLP profile ↗
ORCID search ↗
×1
Papers
ART-ASyn: Anatomy-aware Realistic Texture-based Anomaly Synthesis Framework for Chest X-Rays
WACV 2026
·
Qinyi Cao
DBLP profile ↗
ORCID search ↗
Gene-DML: Dual-Pathway Multi-Level Discrimination for Gene Expression Prediction from Histopathology Images
WACV 2026
·
Yaxuan Song
DBLP profile ↗
ORCID search ↗
Gotta Hear Them All: Towards Sound Source Aware Audio Generation
AAAI 2026
·
Wei Guo
DBLP profile ↗
ORCID search ↗
HiFusion: Hierarchical Intra-Spot Alignment and Regional Context Fusion for Spatial Gene Expression Prediction from Histopathology
AAAI 2026
·
Ziqiao Weng
DBLP profile ↗
ORCID search ↗
Through the Magnifying Glass: Adaptive Perception Magnification for Hallucination-Free VLM Decoding
ACL 2026
·
Shunqi Mao
DBLP profile ↗
ORCID search ↗
UniME-V2: MLLM-as-a-Judge for Universal Multimodal Embedding Learning
AAAI 2026
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
AMNCutter: Affinity-Attention-Guided Multi-View Normalized Cutter for Unsupervised Surgical Instrument Segmentation
WACV 2025
·
Mingyu Sheng
DBLP profile ↗
ORCID search ↗
Breaking the Modality Barrier: Universal Embedding Learning with Multimodal LLMs
ACM MM 2025
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
CA-W3D: Leveraging Context-Aware Knowledge for Weakly Supervised Monocular 3D Detection
IROS 2025
·
Chupeng Liu
DBLP profile ↗
ORCID search ↗
CLIP-CID: Efficient CLIP Distillation via Cluster-Instance Discrimination
AAAI 2025
·
Kaicheng Yang
DBLP profile ↗
ORCID search ↗
ChoreoMuse: Robust Music-to-Dance Video Generation with Style Transfer and Beat-Adherent Motion
ACM MM 2025
·
Xuanchen Wang
DBLP profile ↗
ORCID search ↗
Dance any Beat: Blending Beats with Visuals in Dance Video Generation
WACV 2025
·
Xuanchen Wang
DBLP profile ↗
ORCID search ↗
Diversity-Augmented Diffusion Network With LLM Assistance For Radiology Report Generation
WWW 2025
·
Jieting Long
DBLP profile ↗
ORCID search ↗
LLM-UM: The 1st Workshop on Large Language Model Using Multi-modal Data for User Modeling
WWW 2025
·
Zhicheng Lu
DBLP profile ↗
ORCID search ↗
Multimodal Causal Reasoning Benchmark: Challenging Multimodal Large Language Models to Discern Causal Links Across Modalities
ACL 2025
·
Zhiyuan Li
DBLP profile ↗
ORCID search ↗
ORID: Organ-Regional Information Driven Framework for Radiology Report Generation
WACV 2025
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
RealSyn: An Effective and Scalable Multimodal Interleaved Document Transformation Paradigm
ACM MM 2025
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
ScSAM: Debiasing Morphology and Distributional Variability in Subcellular Semantic Segmentation
ECAI 2025
·
Bo Fang
DBLP profile ↗
ORCID search ↗
Seek Inner: LLM-Enhanced Information Mining for Medical Visual Question Answering
WWW 2025
·
Ao Ma
DBLP profile ↗
ORCID search ↗
VRM: Knowledge Distillation via Virtual Relation Matching
ICCV 2025
·
Weijia Zhang
DBLP profile ↗
ORCID search ↗
Accurate Fetal Head Descent Assessment During Labor Using Video Swin Transformer and Wavelet-Based Multitask Learning for 2024 MICCAI Challenge IUGC
MICCAI 2024
·
Jie Gan
DBLP profile ↗
ORCID search ↗
Advancements in 3D Lane Detection Using LiDAR Point Clouds: From Data Collection to Model Development
ICRA 2024
·
Runkai Zhao
DBLP profile ↗
ORCID search ↗
Controllable Contextualized Image Captioning: Directing the Visual Narrative Through User-Defined Highlights
ECCV 2024
·
Shunqi Mao
DBLP profile ↗
ORCID search ↗
Cross-Domain Fiber Cluster Shape Analysis for Language Performance Cognitive Score Prediction
MICCAI 2024
·
Yui Lo
DBLP profile ↗
ORCID search ↗
Cross-View Consistency Regularisation for Knowledge Distillation
ACM MM 2024
·
Weijia Zhang
DBLP profile ↗
ORCID search ↗
Device-Wise Federated Network Pruning
CVPR 2024
·
Shangqian Gao
DBLP profile ↗
ORCID search ↗
EgoSG: Learning 3D Scene Graphs from Egocentric RGB-D Sequences
CVPR 2024
·
Chaoyi Zhang
DBLP profile ↗
ORCID search ↗
Enhancing Advanced Visual Reasoning Ability of Large Language Models
EMNLP 2024
·
Zhiyuan Li
DBLP profile ↗
ORCID search ↗
LaPA: Latent Prompt Assist Model for Medical Visual Question Answering
CVPR 2024
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
LaneCMKT: Boosting Monocular 3D Lane Detection with Cross-Modal Knowledge Transfer
ACM MM 2024
·
Runkai Zhao
DBLP profile ↗
ORCID search ↗
PaintHuman: Towards High-Fidelity Text-to-3D Human Texturing via Denoised Score Distillation
AAAI 2024
·
Jianhui Yu
DBLP profile ↗
ORCID search ↗
RWKV-CLIP: A Robust Vision-Language Representation Learner
EMNLP 2024
·
Tiancheng Gu
DBLP profile ↗
ORCID search ↗
Rethinking Domain Adaptive Optic Disc and Cup Segmentation in Fundus Image through Dynamic Diffusion Flow
BMVC 2024
·
Canran Li
DBLP profile ↗
ORCID search ↗
Revisiting Adaptive Cellular Recognition Under Domain Shifts: A Contextual Correspondence View
ECCV 2024
·
Jianan Fan
DBLP profile ↗
ORCID search ↗
SAT-Morph: Unsupervised Deformable Medical Image Registration Using Vision Foundation Models with Anatomically Aware Text Prompt
MICCAI 2024
·
Hao Xu
DBLP profile ↗
ORCID search ↗
Seeing Unseen: Discover Novel Biomedical Concepts via Geometry-Constrained Probabilistic Modeling
CVPR 2024
·
Jianan Fan
DBLP profile ↗
ORCID search ↗
Symmetry Awareness Encoded Deep Learning Framework for Brain Imaging Analysis
MICCAI 2024
·
Yang Ma
DBLP profile ↗
ORCID search ↗
Unsupervised Domain Adaptation for Tubular Structure Segmentation Across Different Anatomical Sources
BMVC 2024
·
Yuxiang An
DBLP profile ↗
ORCID search ↗
V2A-Mapper: A Lightweight Solution for Vision-to-Audio Generation by Connecting Foundation Models
AAAI 2024
·
Heng Wang
DBLP profile ↗
ORCID search ↗