P
PaperPicks
Conferences
Di Wang
12 papers at tracked venues · 10 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
AAAI
×2
ACL
×2
ACM MM
×2
EMNLP
×2
ICML
×2
NeurIPS
×1
SIGMOD
×1
Frequent coauthors
Yudong Zhang
DBLP profile ↗
ORCID search ↗
×3
Siheng Li
DBLP profile ↗
ORCID search ↗
×1
Yixing Li
DBLP profile ↗
ORCID search ↗
×1
Songhao Wu
DBLP profile ↗
ORCID search ↗
×1
Ang Lv
DBLP profile ↗
ORCID search ↗
×1
An Wang
DBLP profile ↗
ORCID search ↗
×1
Haoyang Li
DBLP profile ↗
ORCID search ↗
×1
Xingwu Sun
DBLP profile ↗
ORCID search ↗
×1
Shuaipeng Li
DBLP profile ↗
ORCID search ↗
×1
Zhongzhi Chen
DBLP profile ↗
ORCID search ↗
×1
Papers
Reinforcement Learning on Pre-Training Data
ACL 2026
·
Siheng Li
DBLP profile ↗
ORCID search ↗
TransMamba: A Sequence-Level Hybrid Transformer-Mamba Language Model
AAAI 2026
·
Yixing Li
DBLP profile ↗
ORCID search ↗
Union-of-Experts: Neurons in Mixture-of-Experts are Secretly Routers
ACL 2026
·
Songhao Wu
DBLP profile ↗
ORCID search ↗
Autonomy-of-Experts Models
ICML 2025
·
Ang Lv
DBLP profile ↗
ORCID search ↗
DHCP: Detecting Hallucinations by Cross-modal Attention Pattern in Large Vision-Language Models
ACM MM 2025
·
Yudong Zhang
DBLP profile ↗
ORCID search ↗
Fighting Fire with Fire (F3): A Training-free and Efficient Visual Adversarial Example Purification Method in LVLMs
ACM MM 2025
·
Yudong Zhang
DBLP profile ↗
ORCID search ↗
HMoE: Heterogeneous Mixture of Experts for Language Modeling
EMNLP 2025
·
An Wang
DBLP profile ↗
ORCID search ↗
Hydraulis: Balancing Large Transformer Model Training via Co-designing Parallel Strategies and Data Assignment
SIGMOD 2025
·
Haoyang Li
DBLP profile ↗
ORCID search ↗
Scaling Laws for Floating-Point Quantization Training
ICML 2025
·
Xingwu Sun
DBLP profile ↗
ORCID search ↗
The Security Threat of Compressed Projectors in Large Vision-Language Models
EMNLP 2025
·
Yudong Zhang
DBLP profile ↗
ORCID search ↗
Surge Phenomenon in Optimal Learning Rate and Batch Size Scaling
NeurIPS 2024
·
Shuaipeng Li
DBLP profile ↗
ORCID search ↗
Truth Forest: Toward Multi-Scale Truthfulness in Large Language Models through Intervention without Tuning
AAAI 2024
·
Zhongzhi Chen
DBLP profile ↗
ORCID search ↗