PPaperPicks

Xiaohong Liu

Shanghai Jiao Tong University, China

54 papers at tracked venues · 49 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Audio-Assisted Face Video Restoration with Temporal and Identity Complementary Learning
  2. GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal Models
  3. HiFi-Mesh: High-Fidelity Efficient 3D Mesh Generation via Compact Autoregressive Dependence
  4. Scaling-up Perceptual Video Quality Assessment
  5. A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
  6. AU-IQA: A Benchmark Dataset for Perceptual Quality Assessment of AI-Enhanced User-Generated Content
  7. AnimateQR: Bridging Aesthetics and Functionality in Dynamic QR Code Generation
  8. Evaluating Perceptual Color Preferences in Smartphone Photography: Dataset and Challenges
  9. Image Quality Assessment: From Human to Machine Preference
  10. Improving Video Generation with Human Feedback
  11. Information Density Principle for MLLM Benchmarks
  12. Learning Hazing to Dehazing: Towards Realistic Haze Generation for Real-World Image Dehazing
  13. Learning to See in the Extremely Dark
  14. Leveraging Multimodal Large Language Models for Joint Discrete and Continuous Evaluation in Text-to-Image Alignment
  15. Lumina-Image 2.0: a Unified and Efficient Image Generative Framework
  16. MedIQA: A Scalable Foundation Model for Prompt-Driven Medical Image Quality Assessment
  17. MoEdit: On Learning Quantity Perception for Multi-object Image Editing
  18. NTIRE 2025 XGC Quality Assessment Challenge: Methods and Results
    CVPR 2025 · Xiaohong Liu
  19. NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment
  20. Omni2: Unifying Omnidirectional Image Generation and Editing in an Omni Model
  21. Q-Bench-Video: Benchmark the Video Quality Understanding of LMMs
  22. Q-Eval-100K: Evaluating Visual Quality and Alignment Level for Text-to-Vision Content
  23. Redundancy Principles for MLLMs Benchmarks
  24. Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face Detector
  25. RoboFactory: Exploring Embodied Agent Collaboration with Compositional Constraints
  26. Samba: A Unified Mamba-based Framework for General Salient Object Detection
  27. TR-PTS: Task-Relevant Parameter and Token Selection for Efficient Tuning
  28. Towards a New Paradigm of Visual Signal Compression
  29. UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines
  30. VIKI‑R: Coordinating Embodied Multi-Agent Cooperation via Reinforcement Learning
  31. VQA2: Visual Question Answering for Video Quality Assessment
  32. VQualA 2025 Document Image Quality Assessment Challenge
  33. Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads
  34. AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
  35. AIS 2024 Challenge on Video Quality Assessment of User-Generated Content: Methods and Results
  36. DehazeDCT: Towards Effective Non-Homogeneous Dehazing via Deformable Convolutional Transformer
  37. DiffStega: Towards Universal Training-Free Coverless Image Steganography with Diffusion Models
  38. ECMamba: Consolidating Selective State Space Model with Retinex Guidance for Efficient Multiple Exposure Correction
  39. Face2QR: A Unified Framework for Aesthetic, Face-Preserving, and Scannable QR Code Generation
  40. G-Refine: A General Quality Refiner for Text-to-Image Generation
  41. GLARE: Low Light Image Enhancement via Generative Latent Feature Based Codebook Retrieval
  42. LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
  43. LightenDiffusion: Unsupervised Low-Light Image Enhancement with Latent-Retinex Diffusion Models
  44. NTIRE 2024 Dense and Non-Homogeneous Dehazing Challenge Report
  45. NTIRE 2024 Quality Assessment of AI-Generated Content Challenge
    CVPR 2024 · Xiaohong Liu
  46. On Learning Multi-Modal Forgery Representation for Diffusion Generated Video Detection
  47. Perception-Oriented Video Frame Interpolation via Asymmetric Blending
  48. ShadowRefiner: Towards Mask-free Shadow Removal via Fast Fourier Transformer
  49. Subjective and Objective Quality-of-Experience Assessment for 3D Talking Heads
  50. Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
  51. T2I-Scorer: Quantitative Evaluation on Text-to-Image Generation via Fine-Tuned Large Multi-Modal Models
  52. Text2QR: Harmonizing Aesthetic Customization and Scanning Robustness for Text-Guided QR Code Generation
  53. Towards Open-Ended Visual Quality Comparison
  54. V-PETL Bench: A Unified Visual Parameter-Efficient Transfer Learning Benchmark