PPaperPicks

Wei Li

40 papers at tracked venues · 30 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Fin-STAR: Structure-as-Semantics to Resolve Implicitness in Financial Retrieval
  2. GRIP: Latent Field-Guided Graph Policy for Budget-Constrained Multi-Agent Routing
  3. O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning
  4. Request-Only Optimization for Recommendation Systems
  5. SemanticVLA: Semantic-Aligned Sparsification and Enhancement for Efficient Robotic Manipulation
    AAAI 2026 · Wei Li
  6. iTAG: Inverse Design for Natural Text Generation with Accurate Causal Graph Annotations
  7. AdaCo: Overcoming Visual Foundation Model Noise in 3D Semantic Segmentation via Adaptive Label Correction
  8. AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents
  9. CogVLA: Cognition-Aligned Vision-Language-Action Models via Instruction-Driven Routing & Sparsification
    NeurIPS 2025 · Wei Li
  10. Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation
  11. Describe, Don't Dictate: Semantic Image Editing with Natural Language Intent
  12. Efficient Spiking Point Mamba for Point Cloud Analysis
  13. Expectation Confirmation Preference Optimization for Multi-Turn Conversational Recommendation Agent
  14. GoHD: Gaze-oriented and Highly Disentangled Portrait Animation with Rhythmic Poses and Realistic Expressions
  15. Hierarchical Visual Policy Learning for Long-Horizon Robot Manipulation in Densely Cluttered Scenes
  16. Hybrid Boundary Physics-Informed Neural Networks for Solving Navier-Stokes Equations with Complex Boundary
  17. LION-FS: Fast & Slow Video-Language Thinker as Online Video Assistant
    CVPR 2025 · Wei Li
  18. Learning to Control Free-Form Soft Swimmers
  19. Leveraging SD Map to Augment HD Map-based Trajectory Prediction
  20. LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale
  21. PSBD: Prediction Shift Uncertainty Unlocks Backdoor Detection
    CVPR 2025 · Wei Li
  22. SRefiner: Soft-Braid Attention for Multi-Agent Trajectory Refinement
  23. SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models
  24. The Role of Video Generation in Enhancing Data-Limited Action Understanding
    IJCAI 2025 · Wei Li
  25. Z-Shadow: An Efficient Method for Estimating Bicliques in Massive Graphs Using Füredi's Theorem
  26. ZeroFlow: Overcoming Catastrophic Forgetting is Easier than You Think
  27. Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting
    MICCAI 2024 · Wei Li
  28. Dual-Pipeline with Low-Rank Adaptation for New Language Integration in Multilingual ASR
  29. Enhancing Discourse Dependency Parsing with Sentence Dependency Parsing: A Unified Generative Method Based on Code Representation
  30. HeterGCL: Graph Contrastive Learning Framework on Heterophilic Graph
  31. HybridBooth: Hybrid Prompt Inversion for Efficient Subject-Driven Generation
  32. Improving Context Understanding in Multimodal Large Language Models via Multimodal Composition Learning
    ICML 2024 · Wei Li
  33. Learning Cross-modal Knowledge Reasoning and Heuristic-prompt for Visual-language Navigation
  34. On the Effects of Data Scale on UI Control Agents
    NeurIPS 2024 · Wei Li
  35. PEACE: A Dataset of Pharmaceutical Care for Cancer Pain Analgesia Evaluation and Medication Decision
  36. Physics-Constrained Comprehensive Optical Neural Networks
  37. TOPA: Extending Large Language Models for Video Understanding via Text-Only Pre-Alignment
    NeurIPS 2024 · Wei Li
  38. The Ninth NTIRE 2024 Efficient Super-Resolution Challenge Report
  39. UINav: A Practical Approach to Train On-Device Automation Agents
    NAACL 2024 · Wei Li
  40. UNIMO-G: Unified Image Generation through Multimodal Conditional Diffusion
    ACL 2024 · Wei Li