PPaperPicks

Meng Cao

15 papers at tracked venues · 13 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Bring Your Dreams to Life: Continual Text-to-Video Customization
  2. Video SimpleQA: Towards Factuality Evaluation in Large Video Language Models
    AAAI 2026 · Meng Cao
  3. Video Spatial Reasoning with Object-Centric 3D Rollout
  4. $A_{0}$: An Affordance-Aware Hierarchical Model for General Robotic Manipulation
  5. ClimateIQA: A New Dataset and Benchmark to Advance Vision-Language Models in Meteorology Anomalies Analysis
  6. Evagaussians: Event Stream Assisted Gaussian Splatting from Blurry Images
  7. MUSE: Mamba Is Efficient Multi-scale Learner for Text-video Retrieval
  8. PhyBlock: A Progressive Benchmark for Physical Understanding and Planning via 3D Block Assembly
  9. See the World, Discover Knowledge: A Chinese Factuality Evaluation for Large Vision Language Models
  10. Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
  11. When Large Vision Language Models Meet Multimodal Sequential Recommendation: An Empirical Study
  12. Exploiting Auxiliary Caption for Video Grounding
  13. How to Continually Adapt Text-to-Image Diffusion Models for Flexible Customization?
  14. RAP: Efficient Text-Video Retrieval with Sparse-and-Correlated Adapter
    ACL 2024 · Meng Cao
  15. Textual Inversion and Self-supervised Refinement for Radiology Report Generation