PPaperPicks

Jun Yu

Harbin Institute of Technology, School of Intelligent Science and Technolog, China

39 papers at tracked venues · 37 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition
  2. Knowledge Completes the Vision: A Multimodal Entity-aware Retrieval-Augmented Generation Framework for News Image Captioning
  3. Measuring Social Bias in Vision-Language Models with Face-Only Counterfactuals from Real Photos
  4. Sparse4DGS: 4D Gaussian Splatting for Sparse-Frame Dynamic Scene Reconstruction
  5. A General Framework for Producing Interpretable Semantic Text Embeddings
  6. A Similarity Paradigm Through Textual Regularization Without Forgetting
  7. A Token is Worth over 1, 000 Tokens: Efficient Knowledge Distillation through Low-Rank Clone
  8. APT: Improving Specialist LLM Performance with Weakness Case Acquisition and Iterative Preference Training
  9. AQuilt: Weaving Logic and Self-Inspection into Low-Cost, High-Relevance Data Synthesis for Specialist LLMs
  10. Adaptive Detoxification: Safeguarding General Capabilities of LLMs through Toxicity-Aware Knowledge Editing
  11. Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
  12. D2 ST-Adapter: Disentangled-and-Deformable Spatio-Temporal Adapter for Few-Shot Action Recognition
  13. DiffusionMat: Alpha Matting as Deterministic Sequential Refinement Learning
  14. EditInfinity: Image Editing with Binary-Quantized Generative Models
  15. Enhancing LLM Planning for Robotics Manipulation through Hierarchical Procedural Knowledge Graphs
  16. Enhancing Target-unspecific Tasks through a Features Matrix
  17. Fine-grained Adaptive Visual Prompt for Generative Medical Visual Question Answering
  18. Function-to-Style Guidance of LLMs for Code Translation
  19. Growing a Twig to Accelerate Large Vision-Language Models
  20. LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
  21. Learning Compatible Multi-Prize Subnetworks for Asymmetric Retrieval
  22. MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming
  23. OmniKV: Dynamic Context Selection for Efficient Long-Context LLMs
  24. PRISM: A Framework for Producing Interpretable Political Bias Embeddings with Political-Aware Cross-Encoder
  25. Recognition-Synergistic Scene Text Editing
  26. Safety Alignment via Constrained Knowledge Unlearning
  27. SeaPO: Strategic Error Amplification for Robust Preference Optimization of Large Language Models
  28. Speed Up Your Code: Progressive Code Acceleration Through Bidirectional Tree Editing
  29. Stable Score Distillation
  30. Towards Generalizable Detector for Generated Image
  31. Towards Text-Image Interleaved Retrieval
  32. BCLNet: Bilateral Consensus Learning for Two-View Correspondence Pruning
  33. Facial Identity Anonymization via Intrinsic and Extrinsic Attention Distraction
  34. GLOW: Global Layout Aware Attacks on Object Detection
  35. Graph Context Transformation Learning for Progressive Correspondence Pruning
  36. Latent Representation Reorganization for Face Privacy Protection
  37. Learnability Matters: Active Learning for Video Captioning
  38. MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
  39. Multi-Domain Deep Learning from a Multi-View Perspective for Cross-Border E-commerce Search