PPaperPicks

Bin Li

Fudan University, School of Computer Science, Shanghai, China

16 papers at tracked venues · 14 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Benchmarking Vision-Language Models on Chinese Ancient Documents: From OCR to Knowledge Reasoning
  2. From Intent to Execution: Multimodal Chain-of-Thought Reinforcement Learning for Precise CAD Code Generation
  3. OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding
  4. SCoUT: A Framework for Structured Stereotype Analysis in Language Models
  5. Beyond Task-Specific Reasoning: A Unified Conditional Generative Framework for Abstract Visual Reasoning
  6. CReFT-CAD: Boosting Orthographic Projection Reasoning for CAD via Reinforcement Fine-Tuning
  7. ChatReID: Open-Ended Interactive Person Retrieval via Hierarchical Progressive Tuning for Vision Language Models
  8. Foundation Model Driven Appearance Extraction for Robust Multiple Object Tracking
  9. One-Shot Heterogeneous Federated Learning with Local Model-Guided Diffusion Models
  10. EAFormer: Scene Text Segmentation with Edge-Aware Transformers
  11. Exploring One-Shot Semi-supervised Federated Learning with Pre-trained Diffusion Models
  12. FedDEO: Description-Enhanced One-Shot Federated Learning with Diffusion Models
  13. FedRA: A Random Allocation Strategy for Federated Tuning to Unleash the Power of Heterogeneous Clients
  14. Federated Adaptive Prompt Tuning for Multi-Domain Collaborative Learning
  15. Improving Viewpoint-Independent Object-Centric Representations through Active Viewpoint Selection
  16. Towards Generative Abstract Reasoning: Completing Raven's Progressive Matrix via Rule Abstraction and Selection