PPaperPicks

Ruohan Gao

13 papers at tracked venues · 10 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs
  2. Aurelia: Test-Time Reasoning Distillation in Audio-Visual LLMs
  3. Differentiable Room Acoustic Rendering with Multi-View Vision Priors
  4. EgoAdapt: Adaptive Multisensory Distillation and Policy Learning for Efficient Egocentric Perception
  5. GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning
  6. Hearing Anywhere in Any Environment
  7. Learning to Highlight Audio by Watching Movies
  8. Multisensory Machine Intelligence
    AAAI 2025 · Ruohan Gao
  9. Hearing Anything Anywhere
  10. MEERKAT: Audio-Visual Large Language Model for Grounding in Space and Time
  11. Spherical World-Locking for Audio-Visual Localization in Egocentric Videos
  12. The Audio-Visual Conversational Graph: From an Egocentric-Exocentric Perspective
  13. VMFTransformer: An Angle-Preserving and Auto-Scaling Machine for Multi-Horizon Probabilistic Forecasting