PPaperPicks

Linlin Shen

47 papers at tracked venues · 37 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Benchmarking Egocentric Clinical Intent Understanding Capability for Medical Multimodal Large Language Models
  2. Beyond the Leaderboard: Rethinking Medical Benchmarks for Large Language Models
  3. FineXtrol: Controllable Motion Generation via Fine-Grained Text
  4. Incomplete Multi-view Diabetic Retinopathy Grading via Self-Supervised Inter- and Intra-View Restoration
  5. KoCo: Conditioning Language Model Pre-training on Knowledge Coordinates
  6. Asclepius: A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models
  7. BCE vs. CE in Deep Feature Learning
  8. CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing
  9. D3-Talker: Dual-Branch Decoupled Deformation Fields for Few-Shot 3D Talking Head Synthesis
  10. DAMPER: A Dual-Stage Medical Report Generation Framework with Coarse-Grained MeSH Alignment and Fine-Grained Hypergraph Matching
  11. DAP-MAE: Domain-Adaptive Point Cloud Masked Autoencoder for Effective Cross-Domain Learning
  12. DeeperForward: Enhanced Forward-Forward Training for Deeper and Better Performance
  13. DisFaceRep: Representation Disentanglement for Co-occurring Facial Components in Weakly Supervised Face Parsing
  14. EAGLE: Expert-Guided Self-Enhancement for Preference Alignment in Pathology Large Vision-Language Model
  15. Enhancing Adversarial Transferability by Balancing Exploration and Exploitation with Gradient-Guided Sampling
  16. FaceBench: A Multi-View Multi-Level Facial Attribute VQA Dataset for Benchmarking Face Perception MLLMs
  17. FineMotion: A Dataset and Benchmark with Both Spatial and Temporal Annotation for Fine-Grained Motion Generation and Editing
  18. GM-DF: Generalized Multi-Scenario Deepfake Detection
  19. Like an Ophthalmologist: Dynamic Selection Driven Multi-View Learning for Diabetic Retinopathy Grading
  20. MG-MotionLLM: A Unified Framework for Motion Comprehension and Generation across Multiple Granularities
  21. MedChain: Bridging the Gap Between LLM Agents and Clinical Practice with Interactive Sequence
  22. PerReactor: Offline Personalised Multiple Appropriate Facial Reaction Generation
  23. Smooth Online Multiple Appropriate Facial Reaction Generation
  24. SynFER: Towards Boosting Facial Expression Recognition With Synthetic Data
  25. S³-Mamba: Small-Size-Sensitive Mamba for Lesion Segmentation
  26. TRRG: Towards Truthful Radiology Report Generation With Cross-Modal Disease Clue Enhanced Large Language Models
  27. Taming Anomalies with Down-Up Sampling Networks: Group Center Preserving Reconstruction for 3D Anomaly Detection
  28. Towards Robust Training via Gradient-Diversified Backpropagation
  29. Unknown Pixel Mask Based Fine-tuning of 2D Inpainting Models for Unbounded 3D Scene Generation from a Single Image
  30. WSI-LLaVA: A Multimodal Large Language Model for Whole Slide Image
  31. 🤖 WSI-Agents: A Collaborative Multi-agent System for Multi-modal Whole Slide Image Analysis
  32. A New Dataset and Baseline Model for Rectal Cancer Risk Assessment in Endoscopic Ultrasound Videos
  33. APSeg: Auto-Prompt Network for Cross-Domain Few-Shot Semantic Segmentation
  34. Boosting Adversarial Transferability across Model Genus by Deformation-Constrained Warping
  35. FLIP-80M: 80 Million Visual-Linguistic Pairs for Facial Language-Image Pre-Training
  36. Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation
  37. HairDiffusion: Vivid Multi-Colored Hair Editing via Latent Diffusion
  38. MTaDCS: Moving Trace and Feature Density-Based Confidence Sample Selection Under Label Noise
  39. Multi-Dataset Multi-Task Learning for COVID-19 Prognosis
  40. Multi-Scale Dynamic and Hierarchical Relationship Modeling for Facial Action Units Recognition
  41. PerFRDiff: Personalised Weight Editing for Multiple Appropriate Facial Reaction Generation
  42. Simplify Implant Depth Prediction as Video Grounding: A Texture Perceive Implant Depth Prediction Network
  43. Towards Combating Frequency Simplicity-biased Learning for Domain Generalization
  44. Towards High-resolution 3D Anomaly Detection via Group-Level Feature Contrastive Learning
  45. Tune-an-Ellipse: CLIP Has Potential to Find what you Want
  46. WiNet: Wavelet-Based Incremental Learning for Efficient Medical Image Registration
  47. 💎 GEM: Context-Aware Gaze EstiMation with Visual Search Behavior Matching for Chest Radiograph