PPaperPicks

Zequn Jie

12 papers at tracked venues · 10 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. X-SAM: From Segment Anything to Any Segmentation
  2. CLIP-GS: Unifying Vision-Language Representation with 3D Gaussian Splatting
  3. FlexVAR: Flexible Visual Autoregressive Modeling without Residual Prediction
  4. RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
  5. UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
  6. 3D Weakly Supervised Semantic Segmentation with 2D Vision-Language Guidance
  7. AlignSAM: Aligning Segment Anything Model to Open Context via Reinforcement Learning
  8. InstaGen: Enhancing Object Detection by Training on Synthetic Dataset
  9. Instance-Aware Multi-Camera 3D Object Detection with Structural Priors Mining and Self-Boosting Learning
  10. Investigating Compositional Challenges in Vision-Language Models for Visual Grounding
  11. Lumen: Unleashing Versatile Vision-Centric Capabilities of Large Multimodal Models
  12. Making Large Language Models Better Planners with Reasoning-Decision Alignment