PPaperPicks

Yu Wang

Shanghai Jiao Tong University, Cooperative Medianet Innovation Center, China

27 papers at tracked venues · 17 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Cross-Modal Coreference Alignment: Enabling Reliable Information Transfer in Omni-LLMs
  2. HeteroRAG: A Heterogeneous Retrieval-Augmented Generation Framework for Medical Vision Language Tasks
  3. MedS³: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process Supervision
  4. Miner: Mining Intrinsic Mastery for Data-Efficient RL in Large Reasoning Models
  5. SLoRA: Balancing Plasticity and Forgetting in Large Language Models for Continual Learning
  6. When Seeing Is not Enough: Revealing the Limits of Active Reasoning in MLLMs
  7. AnyTalk: Multi-modal Driven Multi-domain Talking Head Generation
    AAAI 2025 · Yu Wang
  8. Bridging the Dynamic Perception Gap: Training-Free Draft Chain-of-Thought for Dynamic Multimodal Spatial Reasoning
  9. DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction
  10. DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
  11. Dynamic Guided and Domain Applicable Safeguards for Enhanced Security in Large Language Models
  12. EvolveBench: A Comprehensive Benchmark for Assessing Temporal Awareness in LLMs on Evolving Knowledge
  13. Fine-tuning with Reserved Majority for Noise Reduction
  14. ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents
  15. SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant
  16. Towards Omni-RAG: Comprehensive Retrieval-Augmented Generation for Large Language Models in Medical Applications
  17. AdaShield : Safeguarding Multimodal Large Language Models from Structure-Based Attack via Adaptive Shield Prompting
    ECCV 2024 · Yu Wang
  18. DictLLM: Harnessing Key-Value Data Structures with Large Language Models for Enhanced Medical Diagnostics
  19. HSDreport: Heart Sound Diagnosis with Echocardiography Reports
  20. MM-SAP: A Comprehensive Benchmark for Assessing Self-Awareness of Multimodal Large Language Models in Perception
  21. MedCare: Advancing Medical LLMs through Decoupling Clinical Alignment and Knowledge Aggregation
  22. M³AV: A Multimodal, Multigenre, and Multipurpose Audio-Visual Academic Lecture Dataset
  23. ParCo: Part-Coordinating Text-to-Motion Synthesis
  24. RA2FD: Distilling Faithfulness into Efficient Dialogue Systems
  25. SDA: Semantic Discrepancy Alignment for Text-conditioned Image Retrieval
  26. SubgDiff: A Subgraph Diffusion Model to Improve Molecular Representation Learning
  27. TAIA: Large Language Models are Out-of-Distribution Data Learners