PPaperPicks

Yang Gao

Nanjing University, State Key Laboratory for Novel Software Technology, China

45 papers at tracked venues · 38 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Causality-Aware Efficient Exploration for Cooperative Multi-Agent Reinforcement Learning
  2. Faster Game Solving via Asymmetry of Step Sizes
  3. MDTeamGPT: Mitigating Context Collapse and Enabling Self-Evolution in Medical Multi-Agent Reasoning
  4. ManiLong-Shot: Interaction-Aware One-Shot Imitation Learning for Long-Horizon Manipulation
  5. Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
  6. Adapting In-Domain Few-Shot Segmentation to New Domains Without Source Domain Retraining
  7. Association-Focused Path Aggregation for Graph Fraud Detection
  8. Beyond Mandatory Federations: Balancing Egoism, Utilitarianism and Egalitarianism in Mixed-Motive Games
  9. Causal Information Prioritization for Efficient Reinforcement Learning
  10. CoT-VTM: Visual-to-Music Generation with Chain-of-Thought Reasoning
  11. DON'T NEED RETRAINING: A Mixture of DETR and Vision Foundation Models for Cross-Domain Few-Shot Object Detection
  12. Dynamic Multi-Layer Null Space Projection for Vision-Language Continual Learning
  13. Efficient Last-Iterate Convergence in Solving Extensive-Form Games
  14. Enhancing Few-Shot Class-Incremental Learning via Training-Free Bi-Level Modality Calibration
  15. Enhancing Trust-Region Bayesian Optimization via Newton Methods
  16. GravMAD: Grounded Spatial Value Maps Guided Action Diffusion for Generalized 3D Manipulation
  17. In-Context Fully Decentralized Cooperative Multi-Agent Reinforcement Learning
  18. Last-Iterate Convergence of Smooth Regret Matching$+$ Variants in Learning Nash Equilibria
  19. Leveraging Flatness to Improve Information-Theoretic Generalization Bounds for SGD
  20. Multi-Agent Reinforcement Learning with Communication-Constrained Priors
  21. Reducing Variance of Stochastic Optimization for Approximating Nash Equilibria in Normal-Form Games
  22. Towards Empowerment Gain through Causal Structure Learning in Model-Based Reinforcement Learning
  23. Towards Perfection: Building Inter-component Mutual Correction for Retinex-based Low-light Image Enhancement
  24. Angle Robustness Unmanned Aerial Vehicle Navigation in GNSS-Denied Scenarios
  25. Cognizing and Imitating Robotic Skills via a Dual Cognition-Action Architecture
  26. Constructing and Exploring Intermediate Domains in Mixed Domain Semi-supervised Medical Image Segmentation
  27. DGA-GNN: Dynamic Grouping Aggregation GNN for Fraud Detection
  28. Discriminative Feature Decoupling Enhancement for Speech Forgery Detection
  29. Distributionally Robust Graph-based Recommendation System
  30. Diving Segmentation Model into Pixels
  31. Exploiting Inter-sample and Inter-feature Relations in Dataset Distillation
  32. Hybrid Sharing for Multi-Label Image Classification
  33. InsertNeRF: Instilling Generalizability into NeRF with HyperNet Modules
  34. Learn to Preserve and Diversify: Parameter-Efficient Group with Orthogonal Regularization for Domain Generalization
  35. Model LEGO: Creating Models Like Disassembling and Assembling Building Blocks
  36. Optimistic Value Instructors for Cooperative Multi-Agent Reinforcement Learning
  37. PG-LBO: Enhancing High-Dimensional Bayesian Optimization with Pseudo-Label and Gaussian Process Guidance
  38. Re-examining Supervised Dimension Reduction for High-Dimensional Bayesian Optimization
  39. SCaR: Refining Skill Chaining for Long-Horizon Robotic Manipulation via Dual Regularization
  40. STAR: Spatio-Temporal State Compression for Multi-Agent Tasks with Rich Observations
  41. START: A Generalized State Space Model with Saliency-Driven Token-Aware Transformation
  42. Safe and Robust Subgame Exploitation in Imperfect Information Games
  43. The Devil Is in the Statistics: Mitigating and Exploiting Statistics Difference for Generalizable Semi-supervised Medical Image Segmentation
  44. Transformer Doctor: Diagnosing and Treating Vision Transformers
  45. ViT-Calibrator: Decision Stream Calibration for Vision Transformer