PPaperPicks

Bin Fu

20 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Balancing Accuracy and Efficiency in Multi-Turn Intent Classification for LLM-Powered Dialog Systems in Production
  2. GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and a Comprehensive Multimodal Dataset Towards General Medical AI
  3. Integrating Multi-scale and Multi-filtration Topological Features for Medical Image Classification*
  4. AppAgent: Multimodal Agents as Smartphone Users
  5. Fontanimate: High Quality Few-Shot Font Generation Via Animating Font Transfer Process
    ICCV 2025 · Bin Fu
  6. From Intents to Conversations: Generating Intent-Driven Dialogues with Contrastive Learning for Multi-Turn Classification
  7. Interactive Medical Image Segmentation: A Benchmark Dataset and Baseline
  8. Lumina-Image 2.0: a Unified and Efficient Image Generative Framework
  9. MVPaint: Synchronized Multi-View Diffusion for Painting Anything 3D
  10. R2C: Mapping Room to Chessboard to Unlock LLM As Low-Level Action Planner
  11. Blocks as Probes: Dissecting Categorization Ability of Large Multimodal Models
    BMVC 2024 · Bin Fu
  12. Enhanced Visual Instruction Tuning with Synthesized Image-Dialogue Data
  13. GLPI: A Global Layered Prompt Integration approach for Explicit Visual Prompt
  14. GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
  15. Generate Like Experts: Multi-Stage Font Generation by Incorporating Font Transfer Process into Diffusion Models
    CVPR 2024 · Bin Fu
  16. LARA: Linguistic-Adaptive Retrieval-Augmentation for Multi-Turn Intent Classification
  17. MeshXL: Neural Coordinate Field for Generative 3D Foundation Models
  18. Paint3D: Paint Anything 3D With Lighting-Less Texture Diffusion Models
  19. Point2Real: Bridging the Gap between Point Cloud and Realistic Image for Open-World 3D Recognition
  20. SAM-Med3D: Towards General-Purpose Segmentation Models for Volumetric Medical Images