P
PaperPicks
Conferences
Yunhua Zhou
15 papers at tracked venues · 12 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×6
EMNLP
×3
ICLR
×3
NeurIPS
×2
AAAI
×1
Frequent coauthors
Zhiyuan Zeng
DBLP profile ↗
ORCID search ↗
×3
Xinghao Wang
DBLP profile ↗
ORCID search ↗
×2
Yuming Yang
DBLP profile ↗
ORCID search ↗
×1
Qiming Ge
DBLP profile ↗
ORCID search ↗
×1
Jiasheng Ye
DBLP profile ↗
ORCID search ↗
×1
Runyu Peng
DBLP profile ↗
ORCID search ↗
×1
Bo Wang
DBLP profile ↗
ORCID search ↗
×1
Shihan Dou
DBLP profile ↗
ORCID search ↗
×1
Junxuan Wang
DBLP profile ↗
ORCID search ↗
×1
Jun Zhan
DBLP profile ↗
ORCID search ↗
×1
Demin Song
DBLP profile ↗
ORCID search ↗
×1
Papers
How to Set the Learning Rate for Large-Scale Pre-training?
ACL 2026
·
Yunhua Zhou
Which Reasoning Trajectories Teach Students to Reason Better? A Simple Metric of Informative Alignment
ACL 2026
·
Yuming Yang
DBLP profile ↗
ORCID search ↗
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
ICLR 2025
·
Xinghao Wang
DBLP profile ↗
ORCID search ↗
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
ACL 2025
·
Qiming Ge
DBLP profile ↗
ORCID search ↗
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
ICLR 2025
·
Jiasheng Ye
DBLP profile ↗
ORCID search ↗
Firewall Routing: Blocking Leads to Better Hybrid Inference for LLMs
EMNLP 2025
·
Runyu Peng
DBLP profile ↗
ORCID search ↗
Implicit Reward as the Bridge: A Unified View of SFT and DPO Connections
NeurIPS 2025
·
Bo Wang
DBLP profile ↗
ORCID search ↗
Pre-Trained Policy Discriminators are General Reward Models
NeurIPS 2025
·
Shihan Dou
DBLP profile ↗
ORCID search ↗
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
ACL 2025
·
Zhiyuan Zeng
DBLP profile ↗
ORCID search ↗
Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
ICLR 2025
·
Junxuan Wang
DBLP profile ↗
ORCID search ↗
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
ACL 2024
·
Jun Zhan
DBLP profile ↗
ORCID search ↗
Code Needs Comments: Enhancing Code LLMs with Comment Augmentation
ACL 2024
·
Demin Song
DBLP profile ↗
ORCID search ↗
DenoSent: A Denoising Objective for Self-Supervised Sentence Representation Learning
AAAI 2024
·
Xinghao Wang
DBLP profile ↗
ORCID search ↗
Memorize Step by Step: Efficient Long-Context Prefilling with Incremental Memory and Decremental Chunk
EMNLP 2024
·
Zhiyuan Zeng
DBLP profile ↗
ORCID search ↗
Turn Waste into Worth: Rectifying Top-k Router of MoE
EMNLP 2024
·
Zhiyuan Zeng
DBLP profile ↗
ORCID search ↗