PPaperPicks

Jiaming Liu

Peking University, School of Computer Science, Beijing, China

31 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Decomposing the Neurons: Activation Sparsity via Mixture of Experts for Continual Test Time Adaptation
  2. 3DWG: 3D Weakly Supervised Visual Grounding via Category and Instance-Level Alignment
  3. AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation
  4. Fast-in-Slow: A Dual-System VLA Model Unifying Fast Manipulation within Slow Reasoning
  5. Let's Verify and Reinforce Image Generation Step by Step
  6. LiDAR-LLM: Exploring the Potential of Large Language Models for 3D LiDAR Understanding
  7. Lift3D Policy: Lifting 2D Foundation Models for Robust 3D Robotic Manipulation
  8. MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine
  9. Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
  10. PseDet: Revisiting the Power of Pseudo Label in Incremental Object Detection
  11. RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
  12. RwoR: Generating Robot Demonstrations from Human Hand Collection for Policy Learning without Robot
  13. VFM-Adapter: Adapting Visual Foundation Models for Dense Prediction with Dynamic Hybrid Operation Mapping
  14. Any2Point: Empowering Any-Modality Large Models for Efficient 3D Understanding
  15. BEVUDA: Multi-geometric Space Alignments for Domain Adaptive BEV 3D Object Detection
    ICRA 2024 · Jiaming Liu
  16. Cloud-Device Collaborative Learning for Multimodal Large Language Models
  17. Continual-MAE: Adaptive Distribution Masked Autoencoders for Continual Test-Time Adaptation
    CVPR 2024 · Jiaming Liu
  18. Distribution-Aware Continual Test-Time Adaptation for Semantic Segmentation
  19. Efficient Deweahter Mixture-of-Experts with Uncertainty-Aware Feature-Wise Linear Modulation
  20. Exploring Sparse Visual Prompt for Domain Adaptive Dense Prediction
  21. FreeKD: Knowledge Distillation via Semantic Frequency Prompt
  22. LLM as Dataset Analyst: Subpopulation Structure Discovery with Large Language Model
  23. Learning from Mistakes: Iterative Prompt Relabeling for Text-to-Image Diffusion Model Training
  24. Leveraging Imagery Data with Spatial Point Prior for Weakly Semi-supervised 3D Object Detection
  25. ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation
  26. NTO3D: Neural Target Object 3D Reconstruction with Segment Anything
  27. No Time to Train: Empowering Non-Parametric Networks for Few-Shot 3D Scene Segmentation
  28. RenderOcc: Vision-Centric 3D Occupancy Prediction with 2D Rendering Supervision
  29. RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation
    NeurIPS 2024 · Jiaming Liu
  30. Unsupervised Spike Depth Estimation via Cross-modality Cross-domain Knowledge Transfer
    ICRA 2024 · Jiaming Liu
  31. ViDA: Homeostatic Visual Domain Adapter for Continual Test Time Adaptation
    ICLR 2024 · Jiaming Liu