PPaperPicks

Richang Hong

47 papers at tracked venues · 43 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AMATA: Adaptive Multi-Agent Trajectory Alignment for Knowledge-Intensive Question Answering
  2. Benchmarking Trustworthiness in Multimodal LLMs for Video Understanding
  3. Beyond Semantic Similarity: Appraisal-Guided Chain-of-Thought Reasoning and Retrieval for Multimodal Emotional Support Conversations
  4. Debate over Mixed-knowledge: A Robust Multi-Agent Reasoning Framework for Incomplete Knowledge Graph Question Answering
  5. Deep Hidden Cognition Facilitates Reliable Chain-of-Thought Reasoning
  6. DragNeXt: Rethinking Drag-Based Image Editing
  7. Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation
  8. Post-hoc Provider Fairness Adaptation via Hierarchical Exposure Alignment
  9. QueueEDIT: Structural Self-Correction for Sequential Model Editing in LLMs
  10. RecCocktail: A Generalizable and Efficient Framework for LLM-Based Recommendation
  11. Sparse-Scale Transformer with Bidirectional Awareness for Time Series Forecasting
  12. Taming "Zombie" Agents: A Markov State-Aware Framework for Resilient Multi-Agent Evolution
  13. CARE Transformer: Mobile-Friendly Linear Visual Transformer via Decoupled Dual Interaction
  14. DFGAP: Towards Depth-Free Cross-Category GAParts Perception via Uncertainty-Quantified Modeling
  15. Discrete to Continuous: Generating Smooth Transition Poses from Sign Language Observations
  16. EgoBlind: Towards Egocentric Visual Assistance for the Blind
  17. Fair Personalized Learner Modeling Without Sensitive Attributes
  18. Generalizable Engagement Estimation in Conversation via Domain Prompting and Parallel Attention
  19. Gt-Mean Loss: a Simple Yet Effective Solution for Brightness Mismatch in Low-Light Image Enhancement
  20. I3-MRec: Invariant Learning with Information Bottleneck for Incomplete Modality Recommendation
  21. InterMind: Doctor-Patient-Family Interactive Depression Assessment Empowered by Large Language Models
  22. Invariance Matters: Empowering Social Recommendation via Graph Invariant Learning
  23. Learnable Feature Patches and Vectors for Boosting Low-Light Image Enhancement Without External Knowledge
  24. Listening to the Unspoken: Exploring '365' Aspects of Multimodal Interview Performance Assessment
  25. MCHM25: Multimedia Computing for Health and Medicine
  26. Moderating the Generalization of Score-Based Generative Model
  27. RAGG: Retrieval-Augmented Grasp Generation Model
  28. Rebalancing Contrastive Alignment with Bottlenecked Semantic Increments in Text-Video Retrieval
  29. Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
  30. SURE: Safety Understanding and Reasoning Enhancement for Multimodal Large Language Models
  31. Selective Mixup for Debiasing Question Selection in Computerized Adaptive Testing
  32. Sign-IDD: Iconicity Disentangled Diffusion for Sign Language Production
  33. Text Proxy: Decomposing Retrieval from a 1-to-N Relationship into N 1-to-1 Relationships for Text-Video Retrieval
  34. Traits Run Deep: Enhancing Personality Assessment via Psychology-Guided LLM Representations and Multimodal Apparent Behaviors
  35. VAEmo: Efficient Representation Learning for Visual-Audio Emotion With Knowledge Injection
  36. ViewGauss: A Head Movement Dataset for 6DoF Gaussian Splatting Video Viewing
  37. DAT: Dialogue-Aware Transformer with Modality-Group Fusion for Human Engagement Estimation
  38. Double Correction Framework for Denoising Recommendation
  39. Doubly Abductive Counterfactual Inference for Text-Based Image Editing
  40. Emotional Synchronization for Audio-Driven Talking-Head Generation
  41. Exploring Robust Face-Voice Matching in Multilingual Environments
  42. Few-Shot Learner Parameterization by Diffusion Time-Steps
  43. Graph Bottlenecked Social Recommendation
  44. High-Fidelity Diffusion Editor for Zero-Shot Text-Guided Video Editing
  45. Multimodality Invariant Learning for Multimedia-Based New Item Recommendation
  46. Path-Specific Causal Reasoning for Fairness-aware Cognitive Diagnosis
  47. Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration