PPaperPicks

Peihao Chen

10 papers at tracked venues · 8 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. NaVLA$2$: A Vision-Language-Audio-Action Model for Multimodal Instruction Navigation
  2. 3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
  3. Enhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance
  4. LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences
  5. Learning 3D Persistent Embodied World Models
  6. 3D-VLA: A 3D Vision-Language-Action Generative World Model
  7. CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding
  8. FlexAttention for Efficient High-Resolution Vision-Language Models
  9. MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World
  10. RILA: Reflective and Imaginative Language Agent for Zero-Shot Semantic Audio-Visual Navigation