PPaperPicks

Huijia Zhu

22 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CrisPrune: Combining Contextual Relevance and Intrinsic Saliency for Efficient Visual Token Pruning in MLLMs
  2. BR-ASR: Efficient and Scalable Bias Retrieval Framework for Contextual Biasing ASR in Speech LLM
  3. Can Knowledge be Transferred from Unimodal to Multimodal? Investigating the Transitivity of Multimodal Knowledge Editing
  4. Generalizable Audio Deepfake Detection via Hierarchical Structure Learning and Feature Whitening in Poincaré sphere
  5. Generalizable Audio Deepfake Detection via Risk-Aware Style Alignment and Structural Empirical Risk Minimization
  6. Hybrid Vision Transformer and Convolutional Neural Network for Super-Resolution Image Quality Assessment
  7. InterAnimate: Taming Region-Aware Diffusion Model for Realistic Human Interaction Animation
  8. Sparse Latents Steer Retrieval-Augmented Generation
  9. SpeechFake: A Large-Scale Multilingual Speech Deepfake Dataset Incorporating Cutting-Edge Generation Methods
  10. Stochastic Layer-Wise Shuffle for Improving Vision Mamba Training
  11. Towards Explainable Fake Image Detection with Multi-Modal Large Language Models
  12. VQualA 2025 Challenge on Image Super-Resolution Generated Content Quality Assessment: Methods and Results
  13. WildFake: A Large-Scale and Hierarchical Dataset for AI-Generated Images Detection
  14. COIN-Matting: Confounder Intervention for Image Matting
  15. Chain-of-Rewrite: Aligning Question and Documents for Open-Domain Question Answering
  16. ComFusion: Enhancing Personalized Generation by Instance-Scene Compositing and Fusion
  17. Debiasing In-Context Learning by Instructing LLMs How to Follow Demonstrations
  18. DomainGallery: Few-shot Domain-driven Image Generation by Attribute-centric Finetuning
  19. Modeling Layout Reading Order as Ordering Relations for Visually-rich Document Understanding
  20. Supervised Contrastive Learning for Snapshot Spectral Imaging Face Anti-Spoofing
  21. UNER: A Unified Prediction Head for Named Entity Recognition in Visually-rich Documents
  22. XMC-Agent : Dynamic Navigation over Scalable Hierarchical Index for Incremental Extreme Multi-label Classification