PPaperPicks

Yanyong Zhang

35 papers at tracked venues · 22 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Breaking Model Lock-in: Cost-Efficient Zero-Shot LLM Routing via a Universal Latent Space
  2. FeelWave: Enabling Emotion-Aware Voice Interaction through Noise-Robust mmWave Emotion Sensing
  3. FlowGait: Enabling Robust Long-Term Gait Recognition Across Real-World Covariates with mmWave Radar
  4. MCLMR: A Model-Agnostic Causal Learning Framework for Multi-Behavior Recommendation
  5. Rethinking Popularity Bias in Collaborative Filtering via Analytical Vector Decomposition
  6. TransLLM: A Unified Multi-Task Large Language Model for Urban Transportation via Learnable Prompting
  7. Versatile Vision-Language Model for 3D Computed Tomography
  8. CAFE-AD: Cross-Scenario Adaptive Feature Enhancement for Trajectory Planning in Autonomous Driving
  9. CELLmap: Enhancing LiDAR SLAM Through Elastic and Lightweight Spherical Map Representation
  10. CalibWorkflow: A General MLLM-Guided Workflow for Centimeter-Level Cross-Sensor Calibration
  11. FACE: A General Framework for Mapping Collaborative Filtering Embeddings into LLM Tokens
  12. GraspCoT: Integrating Physical Property Reasoning for 6-DoF Grasping Under Flexible Language Instructions
  13. Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
  14. Improving Efficiency of Answer Set Planning with Rough Solutions from Large Language Models for Robotic Task Planning
  15. InstaDrive: Instance-Aware Driving World Models for Realistic and Consistent Video Generation
  16. Large-Scale Gaussian Splatting SLAM
  17. MT-PCR: Leveraging Modality Transformation for Large-Scale Point Cloud Registration with Limited Overlap
  18. Modalities Contribute Unequally: Enhancing Medical Multi-modal Learning through Adaptive Modality Token Re-balancing
  19. OG-Gaussian: Occupancy Based Street Gaussians for Autonomous Driving
  20. OccMamba: Semantic Occupancy Prediction with State Space Models
  21. PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum
  22. RaCFormer: Towards High-Quality 3D Object Detection via Query-based Radar-Camera Fusion
  23. S3R-GS: Streamlining the Pipeline for Large-Scale Street Scene Reconstruction
  24. SpatialSplat: Efficient Semantic 3D from Sparse Unposed Images
  25. VLMPlanner: Integrating Visual Language Models with Motion Planning
  26. Agent3D-Zero: An Agent for Zero-Shot 3D Understanding
  27. CRPlace: Camera-Radar Fusion with BEV Representation for Place Recognition
  28. CalibFormer: A Transformer-based Automatic LiDAR-Camera Calibration Network
  29. DGR: A General Graph Desmoothing Framework for Recommendation via Global and Local Perspectives
  30. FARFusion V2: A Geometry-based Radar-Camera Fusion Method on the Ground for Roadside Far-Range 3D Object Detection
  31. LDP: A Local Diffusion Planner for Efficient Robot Navigation and Collision Avoidance
  32. MM-Gaussian: 3D Gaussian-based Multi-modal Fusion for Localization and Reconstruction in Unbounded Scenes
  33. OCC-VO: Dense Mapping via 3D Occupancy-Based Visual Odometry for Autonomous Driving
  34. RayFormer: Improving Query-Based Multi-Camera 3D Object Detection via Ray-Centric Strategies
  35. SDAC: A Multimodal Synthetic Dataset for Anomaly and Corner Case Detection in Autonomous Driving