PPaperPicks

Jinhui Tang

Nanjing University of Science and Technology (NJUST), School of Computer Science and Technology, China

47 papers at tracked venues · 39 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. DMAP: Human-Aligned Structural Document Map for Multimodal Document Understanding
  2. HOSIG: Full-Body Human-Object-Scene Interaction Generation with Hierarchical Scene Perception
  3. MAB-DQA: Addressing Query Aspect Importance in Document Question Answering with Multi-Armed Bandits
  4. PC-Flow: Preference Alignment in Flow Matching via Classifier
  5. Spatiotemporal-Untrammelled Mixture of Experts for Multi-Person Motion Prediction
  6. 3D Question Answering via only 2D Vision-Language Models
  7. AIM 2025 Challenge on High FPS Motion Deblurring: Methods and Results
  8. AccCtr: Accelerating Training-Free Conditional Control For Diffusion Models
  9. Aligning Text-to-Image Diffusion Models to Human Preference by Classification
  10. Conducting Conditional Diffusion by Estimating the Mean Vector of von Mises-Fisher Distribution
  11. Cross-modal Collaborative Representation Learning for Text-to-Image Person Retrieval
  12. DISCO: DISCrete nOise for Conditional Control in Text-to-Image Diffusion Models
  13. Diffusion-Guided Knowledge Distillation for Weakly-Supervised Low-Light Semantic Segmentation
  14. EDMG: Towards Efficient Long Dance Motion Generation with Fundamental Movements from Dance Genres
  15. EMControl: Adding Conditional Control to Text-to-Image Diffusion Models via Expectation-Maximization
  16. Efficient Visual State Space Model for Image Deblurring
  17. Exploiting Frequency Dynamics for Enhanced Multimodal Event-Based Action Recognition
  18. FoundIR: Unleashing Million-Scale Training Data to Advance Foundation Models for Image Restoration
  19. Generative Semantic Probing for Vision-Language Models via Hierarchical Feature Optimization
  20. IMAGDressing-v1: Customizable Virtual Dressing
  21. Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model
  22. Mitigating Query Selection Bias in Referring Video Object Segmentation
  23. Multi-scale Activation, Selection, and Aggregation: Exploring Diverse Cues for Fine-Grained Bird Recognition
  24. NTIRE 2025 Challenge on Light Field Image Super-Resolution: Methods and Results
  25. NoiseCtrl: A Sampling-Algorithm-Agnostic Conditional Generation Method for Diffusion Models
  26. OmniGaze: Reward-inspired Generalizable Gaze Estimation in the Wild
  27. Plenodium: Underwater 3D Scene Reconstruction with Plenoptic Medium Representation
  28. Richer Semantics, Better Alignment: Aligning Visual Features with Explicit and Enriched Semantics for Visible-Infrared Person Re-Identification
  29. TEST-V: TEst-time Support-set Tuning for Zero-shot Video Classification
  30. Tensor-Aggregated LoRA in Federated Fine-Tuning
  31. Vision-centric Token Compression in Large Language Model
  32. AIM 2024 Challenge on Efficient Video Super-Resolution for AV1 Compressed Content
  33. ColorMNet: A Memory-Based Deep Spatial-Temporal Feature Propagation Network for Video Colorization
  34. DTS-TPT: Dual Temporal-Sync Test-time Prompt Tuning for Zero-shot Activity Recognition
  35. DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
  36. DoFIT: Domain-aware Federated Instruction Tuning with Alleviated Catastrophic Forgetting
  37. Dual-view Pyramid Network for Video Frame Interpolation
  38. IMAGPose: A Unified Conditional Framework for Pose-Guided Person Generation
  39. MGNet: Learning Correspondences via Multiple Graphs
  40. NTIRE 2024 Challenge on Blind Enhancement of Compressed Image: Methods and Results
  41. NTIRE 2024 Image Shadow Removal Challenge Report
    CVPR 2024 ·
    Florin-Alexandru Vasluianu
  42. PTSR: Prefix-Target Graph-based Sequential Recommendation
  43. Prototypical Prompting for Text-to-image Person Re-identification
  44. Real-Time 4K Super-Resolution of Compressed AVIF Images. AIS 2024 Challenge Survey
  45. The Ninth NTIRE 2024 Efficient Super-Resolution Challenge Report
  46. TrGa: Reconsidering the Application of Graph Neural Networks in Two-View Correspondence Pruning
  47. Unleashing Network Potentials for Semantic Scene Completion