P
PaperPicks
Conferences
Songjun Tu
8 papers at tracked venues · 5 at CORE A* · active 2025–2026
DBLP profile ↗
ORCID search ↗
Venues
AAMAS
×3
NeurIPS
×2
AAAI
×1
ACL
×1
ICLR
×1
Frequent coauthors
Jingbo Sun
DBLP profile ↗
ORCID search ↗
×3
Di He
DBLP profile ↗
ORCID search ↗
×1
Yaocheng Zhang
DBLP profile ↗
ORCID search ↗
×1
Papers
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
ACL 2026
·
Jingbo Sun
DBLP profile ↗
ORCID search ↗
AlphaDecay: Module-wise Weight Decay for Heavy-Tailed Balancing in LLMs
NeurIPS 2025
·
Di He
DBLP profile ↗
ORCID search ↗
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
AAAI 2025
·
Songjun Tu
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
NeurIPS 2025
·
Songjun Tu
Offline Goal-Conditioned Reinforcement Learning with Elastic-Subgoal Diffused Policy Learning
AAMAS 2025
·
Yaocheng Zhang
DBLP profile ↗
ORCID search ↗
Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
AAMAS 2025
·
Songjun Tu
Salience-Invariant Consistent Policy Learning for Generalization in Visual Reinforcement Learning
AAMAS 2025
·
Jingbo Sun
DBLP profile ↗
ORCID search ↗
Unsupervised Zero-Shot Reinforcement Learning via Dual-Value Forward-Backward Representation
ICLR 2025
·
Jingbo Sun
DBLP profile ↗
ORCID search ↗