PPaperPicks

Hao Zhao

Tsinghua University, Institute for AI Industry Research (AIR), Beijing, China

43 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. 3DSceneEditor: Controllable 3D Scene Editing with Gaussian Splatting
  2. FB-4D: Spatial-Temporal Coherent Dynamic 3D Content Generation with Feature Banks
  3. PairCoder: Pair Programming-Inspired Two-Agent Collaboration for Code Generation
  4. AVD2: Accident Video Diffusion for Accident Video Description
  5. Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
  6. CRUISE: Cooperative Reconstruction and Editing in V2X Scenarios using Gaussian Splatting
  7. Chameleon: Fast-Slow Neuro-Symbolic Lane Topology Extraction
  8. Ctrl-U: Robust Conditional Image Generation via Uncertainty-aware Reward Modeling
  9. Delving into Mapping Uncertainty for Mapless Trajectory Prediction
  10. Detect Anything 3D in the Wild
  11. DiST-4D: Disentangled Spatiotemporal Diffusion with Metric Depth for 4D Driving Scene Generation
  12. Diffusion-based Visual Anagram as Multi-task Learning
  13. GS-Occ3D: Scaling Vision-Only Occupancy Reconstruction with Gaussian Splatting
  14. Hi3dgen: High-Fidelity 3D Geometry Generation From Images Via Normal Bridging
  15. Impromptu VLA: Open Weights and Open Data for Driving Vision-Language-Action Models
  16. In-Context Meta LoRA Generation
  17. LiON: Learning Point-Wise Abstaining Penalty for LiDAR Outlier DetectioN Using Diverse Synthetic Data
  18. PUGS: Zero-Shot Physical Understanding with Gaussian Splatting
  19. PartRM: Modeling Part-Level Dynamics with Large Cross-State Reconstruction Model
  20. PosePilot: Steering Camera Pose for Generative World Models with Self-supervised Depth
  21. Reusing Attention for One-stage Lane Topology Understanding
  22. SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models
  23. Self-Aligning Depth-Regularized Radiance Fields for Asynchronous RGB-D Sequences
  24. SparseMeXt: Unlocking the Potential of Sparse Representations for HD Map Construction
  25. TeX-NeRF: Neural Radiance Fields for Novel HADAR View Synthesis
  26. UniScene: Unified Occupancy-centric Driving Scene Generation
  27. Unifying Appearance Codes and Bilateral Grids for Driving Scene Gaussian Splatting
  28. Blending Distributed NeRFs with Tri-stage Robust Pose Optimization
  29. Block-Map-Based Localization in Large-Scale Environment
  30. Camera Relocalization in Shadow-free Neural Radiance Fields
  31. Drone-assisted Road Gaussian Splatting with Cross-view Uncertainty
  32. Dual-frame Fluid Motion Estimation with Test-time Optimization and Zero-divergence Loss
  33. FairDiff: Fair Segmentation with Point-Image Diffusion
  34. Key Patch Proposer: Key Patches Contain Rich Information
  35. Large Language Models Powered Context-aware Motion Prediction in Autonomous Driving
  36. MonoOcc: Digging into Monocular Semantic Occupancy Prediction
  37. PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
  38. SCP-Diff: Spatial-Categorical Joint Prior for Diffusion Based Semantic Image Synthesis
  39. Structured-NeRF: Hierarchical Scene Graph with Neural Representation
  40. SyncTalk: The Devil is in the Synchronization for Talking Head Synthesis
  41. TOD3Cap: Towards 3D Dense Captioning in Outdoor Scenes
  42. Time-conditioned Illumination for Inverse Rendering of Outdoor Scenes
  43. Training-Free Model Merging for Multi-target Domain Adaptation