PPaperPicks

Songjun Tu

8 papers at tracked venues · 5 at CORE A* · active 20252026

Venues

Frequent coauthors

Papers

  1. AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
  2. AlphaDecay: Module-wise Weight Decay for Heavy-Tailed Balancing in LLMs
  3. In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
    AAAI 2025 · Songjun Tu
  4. Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
    NeurIPS 2025 · Songjun Tu
  5. Offline Goal-Conditioned Reinforcement Learning with Elastic-Subgoal Diffused Policy Learning
  6. Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
    AAMAS 2025 · Songjun Tu
  7. Salience-Invariant Consistent Policy Learning for Generalization in Visual Reinforcement Learning
  8. Unsupervised Zero-Shot Reinforcement Learning via Dual-Value Forward-Backward Representation