PPaperPicks

Li Zhang

Fudan University, School of Data Science, Shanghai Key Lab of Intelligent Information Processing, Shanghai, China

31 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Perception in Plan: Coupled Perception and Planning for End-to-End Autonomous Driving
  2. 4D-VLA: Spatiotemporal Vision-Language-Action Pretraining with Cross-Scene Calibration
  3. Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning
  4. BézierGS: Dynamic Urban Scene Reconstruction with Bézier Curve Gaussian Splatting
  5. Diffusion2: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models
  6. Driving View Synthesis on Free-Form Trajectories with Generative Prior
  7. FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise
  8. From Flatland to Space: Teaching Vision-Language Models to Perceive and Reason in 3D
  9. Future-Aware End-to-End Driving: Bidirectional Modeling of Trajectory Planning and Scene Evolution
  10. GS-LiDAR: Generating Realistic LiDAR Point Clouds with Panoramic Gaussian Splatting
  11. IRGS: Inter-Reflective Gaussian Splatting with 2D Gaussian Ray Tracing
  12. Improving Gaussian Splatting with Localized Points Management
  13. MS-Road: Towards Spatiotemporal-Consistent Large-Scale Road Reconstruction
  14. Reflective Gaussian Splatting
  15. TensoFlow: Tensorial Flow-based Sampler for Inverse Rendering
  16. Towards Unified Multimodal Interleaved Generation via Group Relative Policy Optimization
  17. UniMotion: A Unified Motion Framework for Simulation, Prediction and Planning
  18. UniScene: Unified Occupancy-centric Driving Scene Generation
  19. Consistent4D: Consistent 360° Dynamic Object Generation from Monocular Video
  20. DG-SLAM: Robust Dynamic Gaussian Splatting SLAM with Hybrid Pose Optimization
  21. DeMo: Decoupling Motion Forecasting into Directional Intentions and Dynamic States
  22. Enhancing High-Resolution 3D Generation through Pixel-wise Gradient Clipping
  23. LaneGraph2Seq: Lane Topology Extraction with Language Model via Vertex-Edge Encoding and Connectivity Enhancement
  24. Motion Forecasting in Continuous Driving
  25. OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation
  26. Real-time Photorealistic Dynamic Scene Representation and Rendering with 4D Gaussian Splatting
  27. Reason2Drive: Towards Interpretable and Chain-Based Reasoning for Autonomous Driving
  28. Relightable 3D Gaussians: Realistic Point Cloud Relighting with BRDF Decomposition and Ray Tracing
  29. SlowFocus: Enhancing Fine-grained Temporal Understanding in Video LLM
  30. Tetrahedron Splatting for 3D Generation
  31. WoVoGen: World Volume-Aware Diffusion for Controllable Multi-camera Driving Scene Generation