PPaperPicks

Ya Zhang

Shanghai Jiao Tong University, Cooperative Medianet Innovation Center / Shanghai Key Laboratory of Multimedia Processing and Transmissions, China

49 papers at tracked venues · 36 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
  2. MedS³: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process Supervision
  3. Miner: Mining Intrinsic Mastery for Data-Efficient RL in Large Reasoning Models
  4. Versatile Vision-Language Model for 3D Computed Tomography
  5. AutoMedEval: Harnessing Language Models for Automatic Medical Capability Evaluation
  6. Brain-Heart-Gut Guided Multi-constraint Knowledge Distillation for Early Alzheimer's Disease Diagnosis
  7. Combatting Dimensional Collapse in LLM Pre-Training Data via Submodular File Selection
  8. ConText: Driving In-context Learning for Text Removal and Segmentation
  9. DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
  10. Differential-Informed Sample Selection Accelerates Multimodal Contrastive Learning
  11. Fine-tuning with Reserved Majority for Noise Reduction
  12. Learning to Instruct for Visual Instruction Tuning
  13. M3Builder: A Multi-agent System for Automated Machine Learning in Medical Imaging
  14. MRGen: Segmentation Data Engine for Underrepresented MRI Modalities
  15. MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning
  16. MoMa: Modulating Mamba for Adapting Image Foundation Models to Video Recognition
  17. Multi-Agent System for Comprehensive Soccer Understanding
  18. Multi-modal Medical Diagnosis via Large-small Model Collaboration
  19. Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
  20. RAD: Towards Trustworthy Retrieval-Augmented Multi-modal Clinical Diagnosis
  21. RadIR: A Scalable Framework for Multi-grained Medical Image Retrieval via Radiology Report Mining
  22. SaFiRe: Saccade-Fixation Reiteration with Mamba for Referring Image Segmentation
  23. Towards Universal Soccer Video Understanding
  24. Adapting Visual-Language Models for Generalizable Anomaly Detection in Medical Images
  25. Audio-Visual Segmentation via Unlabeled Frame Exploitation
  26. CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical Scenarios
  27. DictLLM: Harnessing Key-Value Data Structures with Large Language Models for Enhanced Medical Diagnostics
  28. Diversified Batch Selection for Training Acceleration
  29. Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts
  30. Exploring Training on Heterogeneous Data with Mixture of Low-rank Adapters
  31. HPC: Hierarchical Progressive Coding Framework for Volumetric Video
  32. HSDreport: Heart Sound Diagnosis with Echocardiography Reports
  33. HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
  34. Knowledge-Enhanced Visual-Language Pretraining for Computational Pathology
  35. Learning Multi-Agent Communication from Graph Modeling Perspective
  36. Locally Estimated Global Perturbations are Better than Local Perturbations for Federated Sharpness-aware Minimization
  37. Long-tailed Diffusion Models with Oriented Calibration
  38. Low-Rank Knowledge Decomposition for Medical Foundation Models
  39. MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models
  40. Mitigating Noisy Correspondence by Geometrical Structure Consistency Learning
  41. Multi-sentence Grounding for Long-Term Instructional Video
  42. On Harmonizing Implicit Subpopulations
  43. Probabilistic Conformal Distillation for Enhancing Missing Modality Robustness
  44. Q-value Regularized Transformer for Offline Reinforcement Learning
  45. RaTEScore: A Metric for Radiology Report Generation
  46. ReMamber: Referring Image Segmentation with Mamba Twister
  47. Reprogramming Distillation for Medical Foundation Models
  48. Revive Re-weighting in Imbalanced Learning by Density Ratio Estimation
  49. TAIA: Large Language Models are Out-of-Distribution Data Learners