PPaperPicks

Yang Li

76 papers at tracked venues · 61 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AT²PO: Agentic Turn-based Policy Optimization via Tree Search
  2. BMAM: Brain-inspired Multi-Agent Memory Framework
    ACL 2026 · Yang Li
  3. DHCM-CACL: Dynamic Hierarchical Cross-modal Mamba with Confidence-Adaptive Contrastive Learning for Multimodal Emotion Recognition
  4. Deeply Seeking Boundary for Lunar Regolith Segmentation
  5. Detecting Training Data of Large Language Models via Expectation Maximization
  6. FVNet: Harnessing Liquid Neural Dynamics for Lightweight Visual Representation
  7. From Imitation to Discrimination: Toward a Generalized Curriculum Advantage Mechanism Enhancing Cross-Domain Reasoning Tasks
  8. GT2-GS: Geometry-aware Texture Transfer for Gaussian Splatting
  9. Generative Giants, Retrieval Weaklings: Why do Multimodal Large Language Models Fail at Multimodal Retrieval?
  10. HyperDiag: Temporal-Regional Hypergraph Learning via Topology-Enhanced State Propagation for Brain Disease Diagnosis
  11. JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation
  12. LM-Lexicon: Improving Definition Modeling via Harmonizing Semantic Experts
  13. MemCoRL: Alternating Co-Optimization of Memory Retrieval and Utilization via Collaborative Reinforcement Learning
  14. OPINE: A Prior-calibrated Scoring Framework for LLM-based Multi-label Scientific Opinion Classification
  15. PrAda-GAN: A Private Adaptive Generative Adversarial Network with Bayes Network Structure
  16. SpaceVLLM: Endowing Multimodal Large Language Model with Spatio-Temporal Video Grounding Capability
  17. Splats in Splats: Robust and Effective 3D Steganography Towards Gaussian Splatting
  18. Student Guides Teacher: Weak-to-Strong Inference via Spectral Orthogonal Exploration
  19. Target-Balanced Score Distillation
  20. Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
  21. Turn-PPO: Turn-Level Advantage Estimation with PPO for Improved Multi-Turn RL in Agentic LLMs
  22. VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
  23. cuFHEDB: GPU-Accelerated Fully Homomorphic Encryption Database
  24. Active Evaluation Acquisition for Efficient LLM Benchmarking
    ICML 2025 · Yang Li
  25. Bottom-Up Reputation Promotes Cooperation with Multi-Agent Reinforcement Learning
  26. COExpander: Adaptive Solution Expansion for Combinatorial Optimization
  27. Can LLMs be Good Graph Judge for Knowledge Graph Construction?
  28. CobraVPS: Code Template Optimization for Better Question Reasoning Accuracy with Visual Program Synthesis
  29. Collaborative Reasoner: Self-Improving Social Agents with Synthetic Conversations
  30. DenseLoRA: Dense Low-Rank Adaptation of Large Language Models
  31. Enhancing Sequential Recommendation with Global Diffusion
  32. Forecasting the Buzz: Enriching Hashtag Popularity Prediction with LLM Reasoning
  33. GLOMA: Global Video Text Spotting with Morphological Association
  34. GUAVA: Generalizable Upper Body 3D Gaussian Avatar
  35. Hint-QPT: Hints for Robust Query Performance Tuning
  36. Improving Factuality with Explicit Working Memory
  37. Incorporating the Refractory Period into Spiking Neural Networks through Spike-Triggered Threshold Dynamics
    ACM MM 2025 · Yang Li
  38. Learning What is Worth Learning: Active and Sequential Domain Adaptation for Multi-modal Gross Tumor Volume Segmentation
  39. MCOD: The First Challenging Benchmark for Multispectral Camouflaged Object Detection
    ACM MM 2025 · Yang Li
  40. ML4CO-Bench-101: Benchmark Machine Learning for Classic Combinatorial Problems on Graphs
  41. MPS-Prover: Advancing Stepwise Theorem Proving by Multi-Perspective Search and Data Curation
  42. Med-VLM: Enhancing Medical Image Segmentation Accuracy Through Vision-Language Model
  43. Meta CLIP 2: A Worldwide Scaling Recipe
  44. Multimodal Progression-Aware Chest X-Ray Image Generation via Controllable Latent Diffusion Model
  45. NTIRE 2025 Challenge on Short-form UGC Video Quality Assessment and Enhancement: Methods and Results
  46. NaturalReasoning: Reasoning in the Wild with 2.8M Challenging Questions
  47. Noise2Score3D: Tweedie's Approach for Unsupervised Point Cloud Denoising
  48. One is Plenty: A Polymorphic Feature Interpreter for Immutable Heterogeneous Collaborative Perception
  49. Optimal Auction Design in the Joint Advertising
    ICML 2025 · Yang Li
  50. PAR2QO: Parametric Penalty-Aware Robust Query Optimization
  51. Parrot: Multilingual Visual Instruction Tuning
  52. Policy Guided Tree Search for Enhanced LLM Reasoning
    ICML 2025 · Yang Li
  53. ProteinConformers: Benchmark Dataset for Simulating Protein Conformational Landscape Diversity and Plausibility
  54. REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing
  55. SEED-Story: Multimodal Long Story Generation with Large Language Model
  56. SF-TIM: A Simple Framework for Enhancing Quadrupedal Robot Jumping Agility by Combining Terrain Imagination and Measurement
  57. StreamGS: Online Generalizable Gaussian Splatting Reconstruction for Unposed Image Streams
    ICCV 2025 · Yang Li
  58. StruDiCO: Structured Denoising Diffusion with Gradient-free Inference-stage Boosting for Memory and Time Efficient Combinatorial Optimization
  59. TG-LLaVA: Text Guided LLaVA via Learnable Latent Embeddings
  60. THD-BAR: Topology Hierarchical Derived Brain Autoregressive Modeling for EEG Generic Representations
  61. Theory-Driven Label-Specific Representation for Incomplete Multi-View Multi-Label Learning
  62. UXAgent: An LLM Agent-Based Usability Testing Framework for Web Design
  63. ActSort: An active-learning accelerated cell sorting algorithm for large-scale calcium imaging datasets
  64. ChunkAttention: Efficient Self-Attention with Prefix-Aware KV Cache and Two-Phase Partition
  65. ClothPPO: A Proximal Policy Optimization Enhancing Framework for Robotic Cloth Manipulation with Observation-Aligned Action Spaces
  66. Contrastive Continual Learning with Importance Sampling and Prototype-Instance Relation Distillation
  67. Language Models as Semantic Indexers
  68. MUTUAL: Towards Holistic Sensing and Inference in the Operating Room
  69. Mixtures of Experts for Audio-Visual Learning
  70. Multi-Modal Automatic Prosody Annotation with Contrastive Pretraining of Speech-Silence and Word-Punctuation
  71. OUCopula: Bi-Channel Multi-Label Copula-Enhanced Adapter-Based CNN for Myopia Screening Based on OU-UWF Images
    IJCAI 2024 · Yang Li
  72. One class classification-based quality assurance of organs-at-risk delineation in radiotherapy
  73. Perceptual Group Tokenizer: Building Perception with Iterative Grouping
  74. SRAP-Agent: Simulating and Optimizing Scarce Resource Allocation Policy with LLM-based Agent
  75. Unleashing the Power of Large Language Models in Zero-shot Relation Extraction via Self-Prompting
  76. Wings: Learning Multimodal LLMs without Text-only Forgetting