P
PaperPicks
Conferences
Heng Wang
25 papers at tracked venues · 16 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
CVPR
×6
ICDAR
×4
ICLR
×3
AAAI
×2
EMNLP
×2
NeurIPS
×2
WACV
×2
ACL
×1
BMVC
×1
ICCV
×1
ICML
×1
Frequent coauthors
Yiming Wang
DBLP profile ↗
ORCID search ↗
×3
Xianhang Li
DBLP profile ↗
ORCID search ↗
×2
Mingfei Han
DBLP profile ↗
ORCID search ↗
×2
Fan Ma
DBLP profile ↗
ORCID search ↗
×2
Ruichang Zhu
DBLP profile ↗
ORCID search ↗
×1
Kang Chen
DBLP profile ↗
ORCID search ↗
×1
Sucheng Ren
DBLP profile ↗
ORCID search ↗
×1
Xintao Wang
DBLP profile ↗
ORCID search ↗
×1
Mude Hui
DBLP profile ↗
ORCID search ↗
×1
Zhao Wang
DBLP profile ↗
ORCID search ↗
×1
Xinyuan Wang
DBLP profile ↗
ORCID search ↗
×1
Zhe Shan
DBLP profile ↗
ORCID search ↗
×1
Papers
A MambaVision-Based Cross-Modal Feature Enhancement Network for Scene Text Super-Resolution
ICDAR 2026
·
Ruichang Zhu
DBLP profile ↗
ORCID search ↗
Improving Implicit Discourse Relation Recognition with Natural Language Explanations from LLMs
AAAI 2026
·
Heng Wang
LVM-Lite: Training Large Vision Models with Efficient Sequential Modeling
WACV 2026
·
Xianhang Li
DBLP profile ↗
ORCID search ↗
Thinking Traps in Long Chain-of-Thought: A Measurable Study and Trap-Aware Adaptive Restart
ACL 2026
·
Kang Chen
DBLP profile ↗
ORCID search ↗
Autoregressive Pretraining with Mamba in Vision
ICLR 2025
·
Sucheng Ren
DBLP profile ↗
ORCID search ↗
BannerAgency: Advertising Banner Design with Multimodal LLM Agents
EMNLP 2025
·
Heng Wang
CoSER: Coordinating LLM-Based Persona Simulation of Established Roles
ICML 2025
·
Xintao Wang
DBLP profile ↗
ORCID search ↗
DCC: Plug-and-Play Dynamic Category Compression for Enhanced Handwritten Text Generation
ICDAR 2025
·
Yiming Wang
DBLP profile ↗
ORCID search ↗
Efficient VideoMAE via Temporal Progressive Training
CVPR 2025
·
Xianhang Li
DBLP profile ↗
ORCID search ↗
HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing
ICLR 2025
·
Mude Hui
DBLP profile ↗
ORCID search ↗
Mirror in the Model: Ad Banner Image Generation via Reflective Multi-LLM and Multi-modal Agents
EMNLP 2025
·
Zhao Wang
DBLP profile ↗
ORCID search ↗
Multimodal Dual-domain Learning for Image Fusion
ICCV 2025
·
Heng Wang
OpenCUA: Open Foundations for Computer-Use Agents
NeurIPS 2025
·
Xinyuan Wang
DBLP profile ↗
ORCID search ↗
ROS-SAM: High-Quality Interactive Segmentation for Remote Sensing Moving Object
CVPR 2025
·
Zhe Shan
DBLP profile ↗
ORCID search ↗
SFRD: Handwritten Mathematical Expressions Generation by Spatial-Aware Feature Refinement Diffusion
ICDAR 2025
·
Yiming Wang
DBLP profile ↗
ORCID search ↗
Shot2Story: A New Benchmark for Comprehensive Understanding of Multi-shot Videos
ICLR 2025
·
Mingfei Han
DBLP profile ↗
ORCID search ↗
VMAs: Video-to-Music Generation via Semantic Alignment in Web Music Videos
WACV 2025
·
Yan-Bo Lin
DBLP profile ↗
ORCID search ↗
VMF-Net: Visual-Aware Multi-representation Fusion Network for Artifact-Free Handwritten Mathematical Expressions Generation
ICDAR 2025
·
Yiming Wang
DBLP profile ↗
ORCID search ↗
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
NeurIPS 2024
·
Ruiqi Zhong
DBLP profile ↗
ORCID search ↗
Exploring the Role of Audio in Video Captioning
CVPR 2024
·
Yuhan Shen
DBLP profile ↗
ORCID search ↗
Future Does Matter: Boosting 3D Object Detection with Temporal Motion Estimation in Point Cloud Sequences
BMVC 2024
·
Rui Yu
DBLP profile ↗
ORCID search ↗
Open-world Instance Segmentation: Top-down Learning with Bottom-up Supervision
CVPR 2024
·
Tarun Kalluri
DBLP profile ↗
ORCID search ↗
Stitching Segments and Sentences towards Generalization in Video-Text Pre-training
AAAI 2024
·
Fan Ma
DBLP profile ↗
ORCID search ↗
Video Recognition in Portrait Mode
CVPR 2024
·
Mingfei Han
DBLP profile ↗
ORCID search ↗
Vista-llama: Reducing Hallucination in Video Language Models via Equal Distance to Visual Tokens
CVPR 2024
·
Fan Ma
DBLP profile ↗
ORCID search ↗