PPaperPicks

Yanfeng Wang

Shanghai Jiao Tong University, China

82 papers at tracked venues · 60 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Cross-Modal Coreference Alignment: Enabling Reliable Information Transfer in Omni-LLMs
  2. Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
  3. HeteroRAG: A Heterogeneous Retrieval-Augmented Generation Framework for Medical Vision Language Tasks
  4. MCP-Flow: Facilitating LLM Agents to Master Real-World, Diverse and Scaling MCP Tools
  5. MedS³: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process Supervision
  6. Miner: Mining Intrinsic Mastery for Data-Efficient RL in Large Reasoning Models
  7. SLoRA: Balancing Plasticity and Forgetting in Large Language Models for Continual Learning
  8. Versatile Vision-Language Model for 3D Computed Tomography
  9. When Seeing Is not Enough: Revealing the Limits of Active Reasoning in MLLMs
  10. 4DGC: Rate-Aware 4D Gaussian Compression for Efficient Streamable Free-Viewpoint Video
  11. AutoMedEval: Harnessing Language Models for Automatic Medical Capability Evaluation
  12. Bridging the Dynamic Perception Gap: Training-Free Draft Chain-of-Thought for Dynamic Multimodal Spatial Reasoning
  13. Combatting Dimensional Collapse in LLM Pre-Training Data via Submodular File Selection
  14. ConText: Driving In-context Learning for Text Removal and Segmentation
  15. DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction
  16. DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
  17. Differential-Informed Sample Selection Accelerates Multimodal Contrastive Learning
  18. Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models
  19. EvolveBench: A Comprehensive Benchmark for Assessing Temporal Awareness in LLMs on Evolving Knowledge
  20. FedDQC: Data Quality Control in Federated Instruction-tuning of Large Language Models
  21. FedMABench: Benchmarking Mobile GUI Agents on Decentralized Heterogeneous User Data
  22. Fine-tuning with Reserved Majority for Noise Reduction
  23. LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant
  24. Learning to Instruct for Visual Instruction Tuning
  25. M3Builder: A Multi-agent System for Automated Machine Learning in Medical Imaging
  26. MRGen: Segmentation Data Engine for Underrepresented MRI Modalities
  27. MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning
  28. MoMa: Modulating Mamba for Adapting Image Foundation Models to Video Recognition
  29. Multi-Agent System for Comprehensive Soccer Understanding
  30. RAD: Towards Trustworthy Retrieval-Augmented Multi-modal Clinical Diagnosis
  31. RadIR: A Scalable Framework for Multi-grained Medical Image Retrieval via Radiology Report Mining
  32. ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents
  33. SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant
  34. SaFiRe: Saccade-Fixation Reiteration with Mamba for Referring Image Segmentation
  35. Synthesizing Post-Training Data for LLMs through Multi-Agent Simulation
  36. Towards Omni-RAG: Comprehensive Retrieval-Augmented Generation for Large Language Models in Medical Applications
  37. Towards Universal Soccer Video Understanding
  38. VRVVC: Variable-Rate NeRF-Based Volumetric Video Compression
  39. Adapting Visual-Language Models for Generalizable Anomaly Detection in Medical Images
  40. An Extensible Framework for Open Heterogeneous Collaborative Perception
  41. Audio-Visual Segmentation via Unlabeled Frame Exploitation
  42. CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical Scenarios
  43. DictLLM: Harnessing Key-Value Data Structures with Large Language Models for Enhanced Medical Diagnostics
  44. Diversified Batch Selection for Training Acceleration
  45. Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts
  46. Editable Scene Simulation for Autonomous Driving via Collaborative LLM-Agents
  47. Exploring Training on Heterogeneous Data with Mixture of Low-rank Adapters
  48. Fake It Till Make It: Federated Learning with Consensus-Oriented Generation
  49. FedLLM-Bench: Realistic Benchmarks for Federated Learning of Large Language Models
  50. HPC: Hierarchical Progressive Coding Framework for Volumetric Video
  51. HSDreport: Heart Sound Diagnosis with Echocardiography Reports
  52. HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
  53. Intelligent Grimm - Open-ended Visual Storytelling via Latent Diffusion Models
  54. Knowledge-Enhanced Visual-Language Pretraining for Computational Pathology
  55. KnowledgeSG: Privacy-Preserving Synthetic Text Generation with Knowledge Distillation from Server
  56. Language-Driven Interactive Traffic Trajectory Generation
  57. Locally Estimated Global Perturbations are Better than Local Perturbations for Federated Sharpness-aware Minimization
  58. Long-tailed Diffusion Models with Oriented Calibration
  59. Low-Rank Knowledge Decomposition for Medical Foundation Models
  60. MADE: Malicious Agent Detection for Robust Multi-Agent Collaborative Perception
  61. MM-SAP: A Comprehensive Benchmark for Assessing Self-Awareness of Multimodal Large Language Models in Perception
  62. MatchTime: Towards Automatic Soccer Game Commentary Generation
  63. MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models
  64. MedCare: Advancing Medical LLMs through Decoupling Clinical Alignment and Knowledge Aggregation
  65. Mitigating Noisy Correspondence by Geometrical Structure Consistency Learning
  66. Multi-sentence Grounding for Long-Term Instructional Video
  67. M³AV: A Multimodal, Multigenre, and Multipurpose Audio-Visual Academic Lecture Dataset
  68. On Harmonizing Implicit Subpopulations
  69. OpenFedLLM: Training Large Language Models on Decentralized Private Data via Federated Learning
  70. Probabilistic Conformal Distillation for Enhancing Missing Modality Robustness
  71. Q-value Regularized Transformer for Offline Reinforcement Learning
  72. RA2FD: Distilling Faithfulness into Efficient Dialogue Systems
  73. RaTEScore: A Metric for Radiology Report Generation
  74. ReMamber: Referring Image Segmentation with Mamba Twister
  75. Reprogramming Distillation for Medical Foundation Models
  76. Revive Re-weighting in Imbalanced Learning by Density Ratio Estimation
  77. Robust Collaborative Perception without External Localization and Clock Devices
  78. SDA: Semantic Discrepancy Alignment for Text-conditioned Image Retrieval
  79. Self-Alignment of Large Language Models via Monopolylogue-based Social Scene Simulation
  80. TAIA: Large Language Models are Out-of-Distribution Data Learners
  81. Towards an End-to-End Framework for Invasive Brain Signal Decoding with Large Language Models
  82. WebUOT-1M: Advancing Deep Underwater Object Tracking with A Million-Scale Benchmark