PPaperPicks

Junge Zhang

18 papers at tracked venues · 11 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Calibration-Aware Policy Optimization for Reasoning LLMs
  2. Persistent Backdoor Attacks Under Continual Fine-Tuning of LLMs
  3. Distribution Optimization Under Gaussian Hypothesis for Domain Adaptive Semantic Segmentation
  4. EPO: Explicit Policy Optimization for Strategic Reasoning in LLMs via Reinforcement Learning
  5. IDEA-Bench: How Far are Generative Models from Professional Designing?
  6. RainbowArena: A Multi-Agent Toolkit for Reinforcement Learning and Large Language Models in Competitive Tabletop Games
  7. Sequential Preference Optimization: Multi-Dimensional Preference Alignment with Implicit Reward Modeling
  8. Uncertainty-Aware Diffusion-Guided Refinement of 3D Scenes
  9. ADMN: Agent-Driven Modular Network for Dynamic Parameter Sharing in Cooperative Multi-Agent Reinforcement Learning
  10. BadRL: Sparse Targeted Backdoor Attack against Reinforcement Learning
  11. Information Bottleneck Based Data Correction in Continual Learning
  12. NeRF-LiDAR: Generating Realistic LiDAR Point Clouds with Neural Radiance Fields
    AAAI 2024 · Junge Zhang
  13. PDiT: Interleaving Perception and Decision-making Transformers for Deep Reinforcement Learning
  14. Population-Based Diverse Exploration for Sparse-Reward Multi-Agent Tasks
  15. Position: Foundation Agents as the Paradigm Shift for Decision Making
  16. ProAgent: Building Proactive Cooperative Agents with Large Language Models
  17. Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
  18. TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient