PPaperPicks

Yuqian Fu

27 papers at tracked venues · 20 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AVA: Attentive VLM Agent for Mastering StarCraft II
  2. Are We Using the Right Benchmark: An Evaluation Framework for Visual Token Compression Methods
  3. CompTrack: Information Bottleneck-Guided Low-Rank Dynamic Token Compression for Point Cloud Tracking
  4. EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question Answering
  5. MergeIT: From Selection to Merging for Efficient Instruction Tuning
  6. 3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection
  7. CamSAM2: Segment Anything Accurately in Camouflaged Videos
  8. DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy
  9. Domain-RAG: Retrieval-Guided Compositional Image Generation for Cross-Domain Few-Shot Object Detection
  10. Empowering LLM Agents with Zero-Shot Optimal Decision-Making through Q-learning
  11. INS: Interaction-aware Synthesis to Enhance Offline Multi-agent Reinforcement Learning
    ICLR 2025 · Yuqian Fu
  12. Learning and Planning Multi-Agent Tasks via an MoE-based World Model
  13. Locate Anything on Earth: Advancing Open-Vocabulary Object Detection for Remote Sensing Community
  14. NTIRE 2025 Challenge on Cross-Domain Few-Shot Object Detection: Methods and Results
    CVPR 2025 · Yuqian Fu
  15. ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric Perspectives
    ICCV 2025 · Yuqian Fu
  16. Offline Goal-Conditioned Reinforcement Learning with Elastic-Subgoal Diffused Policy Learning
  17. RAG-6DPose: Retrieval-Augmented 6D Pose Estimation via Leveraging CAD as Knowledge Base
  18. RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
    EMNLP 2025 · Yuqian Fu
  19. Sequential Multi-Object Grasping with One Dexterous Hand
  20. Understanding Museum Exhibits using Vision-Language Reasoning
  21. XTrack: Multimodal Training Boosts RGB-X Video Object Trackers
  22. Aligning Credit for Multi-Agent Cooperation via Model-based Counterfactual Imagination
  23. Cross-Domain Few-Shot Object Detection via Enhanced Open-Set Object Detector
    ECCV 2024 · Yuqian Fu
  24. Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
  25. MinD-3D: Reconstruct High-Quality 3D Objects in Human Brain
  26. Open-Vocabulary Video Relation Extraction
  27. Test-Time Linear Out-of-Distribution Detection