PPaperPicks

Rui Feng

Fudan University, School of Computer Science, Shanghai Key Laboratory of Intelligent Information Processing, Shanghai, China

26 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. MGPO: Thinking with Images via Multi-Turn Grounding-Based Reinforcement Learning
  2. AOR: Anatomical Ontology-Guided Reasoning for Medical Large Multimodal Model in Chest X-Ray Interpretation
  3. AS-Det: Active Sampling for Adaptive 3D Object Detection in Point Clouds
  4. Advancing Lung Disease Diagnosis in 3D CT Scans
  5. ConTrack3D: Contrastive Learning Contributes Concise 3D Multi-Object Tracking
  6. EgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos
  7. EmoCharacter: Evaluating the Emotional Fidelity of Role-Playing Agents in Dialogues
  8. GLiM: Integrating Graph Transformer and LLM for Document-Level Biomedical Relation Extraction with Incomplete Labeling
  9. Human Simulacra: Benchmarking the Personification of Large Language Models
  10. Multi-Source Covid-19 Detection via Variance Risk Extrapolation
  11. Open-Set Image Tagging with Multi-Grained Text Supervision
  12. Semantic-Aware Hard Negative Mining for Medical Vision-Language Contrastive Pretraining
  13. SplitOcc: Multi-Resolution Sparse Voxel for Efficient LiDAR-Based Semantic Scene Completion
  14. TGSAM-2: Text-Guided Medical Image Segmentation Using Segment Anything Model 2
  15. Text-Promptable Propagation for Referring Medical Image Sequence Segmentation
  16. ADSNet: Cross-Domain LTV Prediction with an Adaptive Siamese Network in Advertising
  17. Advancing COVID-19 Detection in 3D CT Scans
  18. Anatomical Structure-Guided Medical Vision-Language Pre-training
  19. CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
  20. DeepPointMap2: Accurate and Robust LiDAR-Visual SLAM with Neural Descriptors
  21. DeepPointMap: Advancing LiDAR SLAM with Unified Neural Descriptors
  22. Domain Adaptation Using Pseudo Labels for COVID-19 Detection
  23. Mixtures of Experts for Audio-Visual Learning
  24. Retrieval-Augmented Egocentric Video Captioning
  25. Tag2Text: Guiding Vision-Language Model via Image Tagging
  26. Towards Evidential and Class Separable Open Set Object Detection