PPaperPicks

Le Wang

Xi'an Jiaotong University, Institute of Artificial Intelligence and Robotics, China

20 papers at tracked venues · 16 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses Through Reasoning MLLMs
  2. Boosting Point-Supervised Temporal Action Localization through Integrating Query Reformation and Optimal Transport
  3. Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
  4. DynaRend: Learning 3D Dynamics via Masked Future Rendering for Robotic Manipulation
  5. Enhancing Mamba Decoder with Bidirectional Interaction in Multi-Task Dense Prediction
  6. FlowRAM: Grounding Flow Matching Policy with Region-Aware Mamba Framework for Robotic Manipulation
  7. Moment Quantization for Video Temporal Grounding
  8. PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic Manipulation
  9. RefDetector: A Simple Yet Effective Matching-based Method for Referring Expression Comprehension
  10. SAMPO: Scale-wise Autoregression with Motion Prompt for Generative World Models
  11. Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion
  12. Versatile Multimodal Controls for Expressive Talking Human Animation
  13. Analysis-by-Synthesis Transformer for Single-View 3D Reconstruction
  14. Learning Anomalies with Normality Prior for Unsupervised Video Anomaly Detection
  15. Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
  16. PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image Segmentation
  17. Referencing Where to Focus: Improving Visual Grounding with Referential Query
  18. Stepwise Multi-grained Boundary Detector for Point-Supervised Temporal Action Localization
  19. Temporal Correlation Vision Transformer for Video Person Re-Identification
  20. Towards Generalizable Multi-Object Tracking