P
PaperPicks
Conferences
Linjing Li
14 papers at tracked venues · 7 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
EMNLP
×4
AAMAS
×3
ACL
×3
AAAI
×2
ICML
×1
NeurIPS
×1
Frequent coauthors
Zhaohui Yang
DBLP profile ↗
ORCID search ↗
×3
Yifei Wang
DBLP profile ↗
ORCID search ↗
×3
Xingjin Wang
DBLP profile ↗
ORCID search ↗
×2
Shiqi Lei
DBLP profile ↗
ORCID search ↗
×2
Minghui Jia
DBLP profile ↗
ORCID search ↗
×1
Yu Sheng
DBLP profile ↗
ORCID search ↗
×1
Songjun Tu
DBLP profile ↗
ORCID search ↗
×1
Haorui Li
DBLP profile ↗
ORCID search ↗
×1
Papers
Entropy Scheduling in Reinforcement Learning for Large Language Models
ACL 2026
·
Xingjin Wang
DBLP profile ↗
ORCID search ↗
Spec-o3: A Tool-Augmented Vision-Language Agent for Rare Celestial Object Candidate Vetting via Automated Spectral Inspection
ACL 2026
·
Minghui Jia
DBLP profile ↗
ORCID search ↗
Beyond the First Error: Process Reward Models for Reflective Mathematical Reasoning
EMNLP 2025
·
Zhaohui Yang
DBLP profile ↗
ORCID search ↗
CPE: A New Paradigm for Policy Extraction in Offline Reinforcement Learning
AAMAS 2025
·
Zhaohui Yang
DBLP profile ↗
ORCID search ↗
Learning Dynamics in Continual Pre-Training for Large Language Models
ICML 2025
·
Xingjin Wang
DBLP profile ↗
ORCID search ↗
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
AAAI 2025
·
Shiqi Lei
DBLP profile ↗
ORCID search ↗
Learning Theorem Rationale for Improving the Mathematical Reasoning Capability of Large Language Models
AAAI 2025
·
Yu Sheng
DBLP profile ↗
ORCID search ↗
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
NeurIPS 2025
·
Songjun Tu
DBLP profile ↗
ORCID search ↗
Offline Meta Reinforcement Learning with Weighted Policy Constraints and Proximal Context Collection
AAMAS 2025
·
Haorui Li
DBLP profile ↗
ORCID search ↗
POSITION BIAS MITIGATES POSITION BIAS: Mitigate Position Bias Through Inter-Position Knowledge Distillation
EMNLP 2025
·
Yifei Wang
DBLP profile ↗
ORCID search ↗
Uncertainty Unveiled: Can Exposure to More In-context Examples Mitigate Uncertainty for Large Language Models?
ACL 2025
·
Yifei Wang
DBLP profile ↗
ORCID search ↗
Unearthing Gems from Stones: Policy Optimization with Negative Sample Augmentation for LLM Reasoning
EMNLP 2025
·
Zhaohui Yang
DBLP profile ↗
ORCID search ↗
ELA: Exploited Level Augmentation for Offline Learning in Zero-Sum Games
AAMAS 2024
·
Shiqi Lei
DBLP profile ↗
ORCID search ↗
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
EMNLP 2024
·
Yifei Wang
DBLP profile ↗
ORCID search ↗