P
PaperPicks
Conferences
← All conferences
Editions
2026
2025
2024
ACM MM
2025
A*
ACM International Conference on Multimedia
Official site ↗
1,657
accepted papers
1,591
authors
October 27-31, 2025
dates
Ireland
location
1,657
/ 1,657 papers
All
1,657
Main Track
1,655
Editorship
2
1
'Hi AirStar, Guide Me to the Badminton Court.'
Ziqin Wang
DBLP profile ↗
ORCID search ↗
2
'What Can I Cook?' LetMeCook: An LLM-Based Interactive System for Personalized Recipe Generation
Shiqin Liu
DBLP profile ↗
ORCID search ↗
3
(DFF '25) 1st Deepfake Forensics Workshop: Detection, Attribution, Recognition, and Adversarial Challenges in the Era of AI-Generated Media
Sebastiano Battiato
DBLP profile ↗
ORCID search ↗
4
(RichMediaGAI'25) 3rd International Workshop on Rich Media with Generative AI
Wei Jiang
DBLP profile ↗
ORCID search ↗
5
3D Gaussian Splatting Data Compression with Mixture of Priors
Lei Liu
DBLP profile ↗
ORCID search ↗
6
3DAffordSplat: Efficient Affordance Reasoning with 3D Gaussians
Zeming Wei
DBLP profile ↗
ORCID search ↗
7
3DGabSplat: 3D Gabor Splatting for Frequency-adaptive Radiance Field Rendering
Junyu Zhou
DBLP profile ↗
ORCID search ↗
8
3DGS-IEval-15K: A Large-scale Image Quality Evaluation Database for 3D Gaussian-Splatting
Yuke Xing
DBLP profile ↗
ORCID search ↗
9
3DV-TON: Textured 3D-Guided Consistent Video Try-on via Diffusion Models
Min Wei
DBLP profile ↗
ORCID search ↗
10
8th ACM International Workshop on Multimedia Content Analysis in Sports (ACM MMSports'25)
Rainer Lienhart
DBLP profile ↗
ORCID search ↗
11
A Comprehensive Benchmark for Electrocardiogram Time-Series
Zhijiang Tang
DBLP profile ↗
ORCID search ↗
12
A Comprehensive Model for Visual Fatigue Assessment in 3D Light Field Displays Based on Eye Movement Data Analysis
Yu Chen
DBLP profile ↗
ORCID search ↗
13
A Data-driven Approach to the Longitudinal Study of Canine Vocal Pattern Development
Hridayesh Lekhak
DBLP profile ↗
ORCID search ↗
14
A Dataset and Metric for Textual Video Content Description
Stefan J. Arzberger
DBLP profile ↗
ORCID search ↗
15
A Dual-Branch 3D Spatial-Aware Latent Diffusion for Realistic Depth Image Synthesis
Shuang Hao
DBLP profile ↗
ORCID search ↗
16
A Dual-Branch Ensemble Framework for Personality Recognition Based on Multimodal Emotion Features
Renjie Yu
DBLP profile ↗
ORCID search ↗
17
A Filtering Framework for Semi-online Referring Video Object Segmentation
Xiao Hu
DBLP profile ↗
ORCID search ↗
18
A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task
Mashiro Toyooka
DBLP profile ↗
ORCID search ↗
19
A Language-Assisted Semantic-Aware Disentangled Method for Link Prediction on Heterogeneous Graphs
Rongqiang Fang
DBLP profile ↗
ORCID search ↗
20
A Large-Scale Dataset for Short-Video Topic Peak Prediction and a Large Heterogeneous Graph Model
Shangheng Chen
DBLP profile ↗
ORCID search ↗
21
A Large-scale Universal Evaluation Benchmark For Face Forgery Detection
Hengrui Lou
DBLP profile ↗
ORCID search ↗
22
A Lightweight Multimodal Framework for Big Five Personality Trait Prediction
Taiyu Niu
DBLP profile ↗
ORCID search ↗
23
A Matter of Time: Revealing the Structure of Time in Vision-Language Models
Nidham Tekaya
DBLP profile ↗
ORCID search ↗
24
A Motion is Worth a Hybrid Sentence: Taming Language Model for Unified Motion Generation by Fine-grained Planning
Ronghui Li
DBLP profile ↗
ORCID search ↗
25
A Multi-illumination Dataset and an Illumination Domain Adaptation Network for Finger Vein Identification
Huabin Wang
DBLP profile ↗
ORCID search ↗
26
A Multimodal Deviation Perceiving Framework for Weakly-Supervised Temporal Forgery Localization
Wenbo Xu
DBLP profile ↗
ORCID search ↗
27
A Multimodal Evaluation Framework for Spatial Audio Playback Systems: From Localization to Listener Preference
Changhao Pan
DBLP profile ↗
ORCID search ↗
28
A Neural Representation Framework with LLM-Driven Spatial Reasoning for Open-Vocabulary 3D Visual Grounding
Zhenyang Liu
DBLP profile ↗
ORCID search ↗
29
A New Dataset and Benchmark for Grounding Multimodal Misinformation
Bingjian Yang
DBLP profile ↗
ORCID search ↗
30
A Novel Perspective on Low-Light Image Enhancement: Leveraging Artifact Regularization and Walsh-Hadamard Transform
Weilin Wu
DBLP profile ↗
ORCID search ↗
31
A Satellite-Ground Synergistic Large Vision-Language Model System for Earth Observation
Yuxin Zhang
DBLP profile ↗
ORCID search ↗
32
A Spatial Relationship Aware Dataset for Robotics
Peng Wang
DBLP profile ↗
ORCID search ↗
33
A Streamlined System for Multimodal Industrial Anomaly Detection via 2D and 3D Feature Fusion
Wenbing Zhu
DBLP profile ↗
ORCID search ↗
34
A Theoretical Proof of Dynamic Multimodal Fusion Exacerbates Modality Greedy
Xiaorui Ding
DBLP profile ↗
ORCID search ↗
35
A Two-Stage Full Fine-Tuning and LLM Post-processing Framework for MCABSA
Deyuan Chen
DBLP profile ↗
ORCID search ↗
36
A Unified Framework for Stealthy Adversarial Generation via Latent Optimization and Transferability Enhancement
Gaozheng Pei
DBLP profile ↗
ORCID search ↗
37
AB-Cache: Training-Free Acceleration of Diffusion Models via Adams-Bashforth Cached Feature Reuse
Zichao Yu
DBLP profile ↗
ORCID search ↗
38
Abstractive Visual Understanding of Multi-modal Structured Knowledge: A New Perspective for MLLM Evaluation
Yichi Zhang
DBLP profile ↗
ORCID 0009-0007-4046-1003 ↗
39
Accelerating Diffusion Models via Parallel Denoising
Yanming Chen
DBLP profile ↗
ORCID search ↗
40
Accelerating Diffusion Transformer via Error-Optimized Cache
Junxiang Qiu
DBLP profile ↗
ORCID search ↗
41
Accelerating Long Video Understanding via Compressed Scene Graph-Enabled Chain-of-Thought
Tao Ling
DBLP profile ↗
ORCID search ↗
42
ACE: Concept Editing in Diffusion Models without Performance Degradation
Ruipeng Wang
DBLP profile ↗
ORCID search ↗
43
ACM Multimedia 2025 Grand Challenge report for Image-to-Video Generation Model Acceleration
Jie Yang
DBLP profile ↗
ORCID search ↗
44
ACM Multimedia Grand Challenge on ENT Endoscopy Analysis
Trong-Thuan Nguyen
DBLP profile ↗
ORCID search ↗
45
ACMamba: Fast Unsupervised Anomaly Detection via An Asymmetrical Consensus State Space Model
Guanchun Wang
DBLP profile ↗
ORCID search ↗
46
Action Unit Enhance Dynamic Facial Expression Recognition
Feng Liu
DBLP profile ↗
ORCID search ↗
47
Activation and Weight Distribution Balancing for Optimal Post-Training Quantization in Learned Image Compression
Jie Yu
DBLP profile ↗
ORCID search ↗
48
Activation Shape Matters: OOD Detection with Norm-Entropy Fusion
Jiawei Gu
DBLP profile ↗
ORCID search ↗
49
AdaDocVQA: Adaptive Framework for Long Document Visual Question Answering in Low-Resource Settings
Haoxuan Li
DBLP profile ↗
ORCID search ↗
50
Adaptive Graph Attention-Guided Parallel Sampling and Embedded Selection for Multi-Model Fitting
Wenyu Yin
DBLP profile ↗
ORCID search ↗
Show 100 more
(1,607 left)