PPaperPicks

Xun Yang

University of Science and Technology of China, Department of Electronic Engineering and Information Science, China

38 papers at tracked venues · 35 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. BalDRO: A Distributionally Robust Optimization based Framework for Large Language Model Unlearning
  2. Causality-Aligned Semantic Recovery for Incomplete Cross-Modal Retrieval
  3. DeFT-LoRA: Decoupled and Fused Tuning with LoRA Experts for Universal Cross-Domain Retrieval
  4. From Social Media to Psychological Scale: An Adaptive Framework with Two-Hop Retrieval for Depression Screening
  5. Maximizing Local Entropy Where It Matters: Prefix-Aware Localized LLM Unlearning
  6. Multi-Agent Debate based Concept Augmentation for Enhanced Cognitive Diagnosis
  7. Psyche-R1: Towards Reliable Psychological LLMs through Unified Empathy, Expertise, and Reasoning
  8. AffordBot: 3D Fine-grained Embodied Reasoning via Multimodal Large Language Models
  9. AlphaFuse: Learn ID Embeddings for Sequential Recommendation in Null Space of Language Embeddings
  10. Audio Does Matter: Importance-Aware Multi-Granularity Fusion for Video Moment Retrieval
  11. AugRefer: Advancing 3D Visual Grounding via Cross-Modal Augmentation and Spatial Relation-based Referring
  12. Benchmarking and Bridging Emotion Conflicts for Multimodal Emotion Reasoning
  13. CMMLoc: Advancing Text-to-PointCloud Localization with Cauchy-Mixture-Model Based Framework
  14. DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
  15. EgoBlind: Towards Egocentric Visual Assistance for the Blind
  16. EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering
  17. Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
  18. Enhancing Semantic Clarity: Discriminative and Fine-grained Information Mining for Remote Sensing Image-Text Retrieval
  19. EverybodyDance: Bipartite Graph-Based Identity Correspondence for Multi-Character Animation
  20. GRPose: Learning Graph Relations for Human Image Generation with Pose Priors
  21. LLM-Assisted Entropy-Based Adaptive Distillation for Unsupervised Fine-Grained Visual Representation Learning
  22. MultiAgentESC: A LLM-based Multi-Agent Collaboration Framework for Emotional Support Conversation
  23. Precise Localization of Memories: A Fine-grained Neuron-level Knowledge Editing Technique for LLMs
  24. QR-LoRA: Efficient and Disentangled Fine-Tuning via QR Decomposition for Customized Generation
  25. Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
  26. Advancing Prompt Learning through an External Layer
  27. Boosting Neural Cognitive Diagnosis with Student's Affective State Modeling
  28. Causality-Inspired Invariant Representation Learning for Text-Based Person Retrieval
  29. Dual-stream Feature Augmentation for Domain Generalization
  30. Enhancing One-Shot Federated Learning Through Data and Ensemble Co-Boosting
  31. FedCAFE: Federated Cross-Modal Hashing with Adaptive Feature Enhancement
  32. Finding and Editing Multi-Modal Neurons in Pre-Trained Transformers
  33. Informative Point cloud Dataset Extraction for Classification via Gradient-based Points Moving
  34. KPA-Tracker: Towards Robust and Real-Time Category-Level Articulated Object 6D Pose Tracking
  35. Maskable Retentive Network for Video Moment Retrieval
  36. Rethinking Human Motion Prediction with Symplectic Integral
  37. Reverse2Complete: Unpaired Multimodal Point Cloud Completion via Guided Diffusion
  38. Temporal Sentence Grounding with Relevance Feedback in Videos