PPaperPicks

Hujun Bao

Zhejiang University, Hangzhou, China

50 papers at tracked venues · 40 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. One-Shot Refiner: Boosting Feed-forward Novel View Synthesis via One-Step Diffusion
  2. StreamingTalker: Audio-driven 3D Facial Animation with Autoregressive Diffusion Model
  3. AccidentalGS: 3D Gaussian Splatting from Accidental Camera Motion
  4. AtlasGS: Atlanta-world Guided Surface Reconstruction with Implicit Structured Gaussians
  5. Bidirectional Temporal-Aware Modeling with Multi-Scale Mixture-of-Experts for Multivariate Time Series Forecasting
  6. BlinkTrack: Feature Tracking Over 80 FPS via Events and Images
  7. DW-VIO: Deep Weighted Visual-Inertial Odometry
  8. Diffuman4D: 4D Consistent Human View Synthesis From Sparse-View Videos With Spatio-Temporal Diffusion Models
  9. ETO+: Revisit the Refinement Stage in Efficient Feature Matching
  10. EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds
  11. EnvGS: Modeling View-Dependent Appearance with Environment Gaussian
  12. FreeTimeGS: Free Gaussian Primitives at Anytime Anywhere for Dynamic Scene Reconstruction
  13. GURecon: Learning Detailed 3D Geometric Uncertainties for Neural Surface Reconstruction
  14. GaussianUpdate: Continual 3D Gaussian Splatting Update for Changing Environments
  15. HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
  16. Hierarchy UGP: Hierarchy Unified Gaussian Primitive for Large-Scale Dynamic Scene Reconstruction
  17. InstaScene: Towards Complete 3D Instance Decomposition and Reconstruction From Cluttered Scenes
  18. IntrinsicControlNet: Cross-Distribution Image Generation with Real and Unreal
  19. LightCity: An Urban Dataset for Outdoor Inverse Rendering and Reconstruction Under Multi-Illumination Conditions
  20. LookCloser: Frequency-aware Radiance Field for Tiny-Detail Scene
  21. MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation
  22. Multi-view Reconstruction via SfM-guided Monocular Depth Estimation
  23. ND-SDF: Learning Normal Deflection Fields for High-Fidelity Indoor Reconstruction
  24. Neuraloc: Visual Localization in Neural Implicit Map With Dual Complementary Features
  25. Precise Action-to-Video Generation Through Visual Action Prompts
  26. Prompting Depth Anything for 4K Resolution Accurate Metric Depth Estimation
  27. ReTracker: Exploring Image Matching for Robust Online Any Point Tracking
  28. Ready-to-React: Online Reaction Policy for Two-Character Interaction Generation
  29. SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion
  30. Scalable Multi-Session Visual SLAM in Large-Scale Scenes with Subgraph Optimization
  31. SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations
  32. SpatialTrackerV2: Advancing 3D Point Tracking with Explicit Camera Motion
  33. StreetCrafter: Street View Synthesis with Controllable Video Diffusion Models
  34. UniRestore3D: A Scalable Framework For General Shape Restoration
  35. UniVerse: Unleashing the Scene Prior of Video Diffusion Models for Robust Radiance Field Reconstruction
  36. 3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
  37. 4K4D: Real-Time 4D View Synthesis at 4K Resolution
  38. A Global Depth-Range-Free Multi-View Stereo Transformer Network with Pose Embedding
  39. BlinkVision: A Benchmark for Optical Flow, Scene Flow and Point Tracking Estimation Using RGB Frames and Events
  40. Boosting Image Restoration via Priors from Pre-Trained Models
  41. CG-SLAM: Efficient Dense RGB-D SLAM in a Consistent Uncertainty-Aware 3D Gaussian Field
  42. Detector-Free Structure from Motion
  43. ETO: Efficient Transformer-based Local Feature Matching by Organizing Multiple Homography Hypotheses
  44. Error-aware Sampling in Adaptive Shells for Neural Surface Reconstruction
  45. From Satellite to Ground: Satellite Assisted Visual Localization with Cross-view Semantic Matching
  46. GeneAvatar: Generic Expression-Aware Volumetric Head Avatar Editing from a Single Image
  47. Generating Human Motion in 3D Scenes from Text Descriptions
  48. Omnidirectional Dense SLAM for Back-to-back Fisheye Cameras
  49. PNeRFLoc: Visual Localization with Point-Based Neural Radiance Fields
  50. Relightable and Animatable Neural Avatar from Sparse-View Video