PPaperPicks

Xinyue Cai

5 papers at tracked venues · 4 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. 4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration
  2. From Flatland to Space: Teaching Vision-Language Models to Perceive and Reason in 3D
  3. ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models
  4. LaneGraph2Seq: Lane Topology Extraction with Language Model via Vertex-Edge Encoding and Connectivity Enhancement
  5. Reason2Drive: Towards Interpretable and Chain-Based Reasoning for Autonomous Driving