PPaperPicks

Xiangyang Xue

Fudan University, Shanghai, China

37 papers at tracked venues · 26 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. From Intent to Execution: Multimodal Chain-of-Thought Reinforcement Learning for Precise CAD Code Generation
  2. LOG-Nav: Efficient Layout-Aware Object-Goal Navigation with Hierarchical Planning
  3. SCoUT: A Framework for Structured Stereotype Analysis in Language Models
  4. A Neural Representation Framework with LLM-Driven Spatial Reasoning for Open-Vocabulary 3D Visual Grounding
  5. Ali-UI: Enhancing Complex Vision-Language Navigation with Alignment of Unified Map and Instruction Parsing
  6. Beyond Task-Specific Reasoning: A Unified Conditional Generative Framework for Abstract Visual Reasoning
  7. CAP-Net: A Unified Network for 6D Pose and Size Estimation of Categorical Articulated Parts from a Single RGB-D Image
  8. CReFT-CAD: Boosting Orthographic Projection Reasoning for CAD via Reinforcement Fine-Tuning
  9. ChatReID: Open-Ended Interactive Person Retrieval via Hierarchical Progressive Tuning for Vision Language Models
  10. CocoER: Aligning Multi-Level Feature by Competition and Coordination for Emotion Recognition
  11. Foundation Model Driven Appearance Extraction for Robust Multiple Object Tracking
  12. MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
  13. One-Shot Heterogeneous Federated Learning with Local Model-Guided Diffusion Models
  14. PC-BEV: An Efficient Polar-Cartesian BEV Fusion Framework for LiDAR Semantic Segmentation
  15. RAG-6DPose: Retrieval-Augmented 6D Pose Estimation via Leveraging CAD as Knowledge Base
  16. ReasonGrounder: LVLM-Guided Hierarchical Feature Splatting for Open-Vocabulary 3D Visual Grounding and Reasoning
  17. Spatial-Temporal Aware Visuomotor Diffusion Policy Learning
  18. TP-MDDN: Task-Preferenced Multi-Demand-Driven Navigation with Autonomous Decision-Making
  19. Towards Enhanced Image Inpainting: Mitigating Unwanted Object Insertion and Preserving Color Consistency
  20. You Only Estimate Once: Unified, One-stage, Real-Time Category-Level Articulated Object 6D Pose Estimation for Robotic Grasping
  21. Automated Label Unification for Multi-Dataset Semantic Segmentation with GNNs
  22. EAFormer: Scene Text Segmentation with Edge-Aware Transformers
  23. Enhancing Cross-Subject fMRI-to-Video Decoding with Global-Local Functional Alignment
  24. Exploring One-Shot Semi-supervised Federated Learning with Pre-trained Diffusion Models
  25. FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
  26. FedDEO: Description-Enhanced One-Shot Federated Learning with Diffusion Models
  27. FedRA: A Random Allocation Strategy for Federated Tuning to Unleash the Power of Heterogeneous Clients
  28. Federated Adaptive Prompt Tuning for Multi-Domain Collaborative Learning
  29. Generating and Reweighting Dense Contrastive Patterns for Unsupervised Anomaly Detection
  30. Improving Neural Surface Reconstruction with Feature Priors from Multi-view Images
  31. Improving Viewpoint-Independent Object-Centric Representations through Active Viewpoint Selection
  32. LAC-Net: Linear-Fusion Attention-Guided Convolutional Network for Accurate Robotic Grasping Under the Occlusion
  33. MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
  34. Make a Strong Teacher with Label Assistance: A Novel Knowledge Distillation Approach for Semantic Segmentation
  35. Multi-LIO: A Lightweight Multiple LiDAR-Inertial Odometry System
  36. OpenAnnotate3D: Open-Vocabulary Auto-Labeling System for Multi-modal 3D Data
  37. Towards Generative Abstract Reasoning: Completing Raven's Progressive Matrix via Rule Abstraction and Selection