PPaperPicks

Xin Jin

Eastern Institute of Technology, Ningbo Institute of Digital Twin, Ningbo, China

33 papers at tracked venues · 24 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Temporal Inconsistency Guidance for Super-resolution Video Quality Assessment
  2. Bridging Past and Future: End-to-End Autonomous Driving with Historical Prediction and Planning
  3. Diff-ICMH: Harmonizing Machine and Human Vision in Image Compression with Generative Prior
  4. Disentangled World Models: Learning to Transfer Semantic Knowledge from Distracting Videos for Reinforcement Learning
  5. DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge
  6. EDBench: Large-Scale Electron Density Data for Molecular Modeling
  7. Electron Density-enhanced Molecular Geometry Learning
  8. GeoFormer: Geometry Point Encoder for 3D Object Detection with Graph-Based Transformer
    ICCV 2025 · Xin Jin
  9. Hybrid-Grained Feature Aggregation with Coarse-to-Fine Language Guidance for Self-Supervised Monocular Depth Estimation
  10. Knowledge Regularized Negative Feature Tuning of Vision-Language Models for Out-of-Distribution Detection
  11. Multimodal Language Models See Better When They Look Shallower
  12. Open-World Reinforcement Learning over Long Short-Term Imagination
  13. Perceiving and Acting in First-Person: A Dataset and Benchmark for Egocentric Human-Object-Human Interactions
  14. RLLTE: Long-Term Evolution Project of Reinforcement Learning
  15. SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object Manipulation
  16. ULTHO: Ultra-Lightweight Yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning
  17. UniMamba: Unified Spatial-Channel Representation Learning with Group-Efficient Mamba for LiDAR-based 3D Object Detection
    CVPR 2025 · Xin Jin
  18. UniScene: Unified Occupancy-centric Driving Scene Generation
  19. Architecture-Agnostic Unsupervised Gradient Regularization for Parameter-Efficient Transfer Learning
  20. Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion
  21. Closed-Loop Unsupervised Representation Disentanglement with β-VAE Distillation and Diffusion Probabilistic Feedback
    ECCV 2024 · Xin Jin
  22. DreamLIP: Language-Image Pre-training with Long Captions
  23. Graph-based Unsupervised Disentangled Representation Learning via Multimodal Large Language Models
  24. HIMO: A New Benchmark for Full-Body Human Interacting with Multiple Objects
  25. Hierarchical Temporal Context Learning for Camera-Based Semantic Scene Completion
  26. Inter-X: Towards Versatile Human-Human Interaction Analysis
  27. Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
  28. Multi-Prompts Learning with Cross-Modal Alignment for Attribute-Based Person Re-identification
  29. One at a Time: Progressive Multi-Step Volumetric Probability Learning for Reliable 3D Scene Perception
  30. Rate-Distortion-Cognition Controllable Versatile Neural Image Compression
  31. ReGenNet: Towards Human Action-Reaction Synthesis
  32. Scene Graph Disentanglement and Composition for Generalizable Complex Image Generation
  33. SwiftPillars: High-Efficiency Pillar Encoder for Lidar-Based 3D Detection
    AAAI 2024 · Xin Jin