P
PaperPicks
Conferences
Jiaming Ji
30 papers at tracked venues · 30 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
ACL
×16
NeurIPS
×8
AAAI
×3
ICLR
×2
ICML
×1
Frequent coauthors
Chi-Min Chan
DBLP profile ↗
ORCID search ↗
×3
Jiayi Zhou
DBLP profile ↗
ORCID search ↗
×2
Tianyi Qiu
DBLP profile ↗
ORCID search ↗
×2
Hantao Lou
DBLP profile ↗
ORCID search ↗
×2
Guoxi Zhang
DBLP profile ↗
ORCID search ↗
×1
Zhiheng Xi
DBLP profile ↗
ORCID search ↗
×1
Lichao Wang
DBLP profile ↗
ORCID search ↗
×1
Han Zhu
DBLP profile ↗
ORCID search ↗
×1
Yujin Zhou
DBLP profile ↗
ORCID search ↗
×1
Sitong Fang
DBLP profile ↗
ORCID search ↗
×1
Wenxuan Wang
DBLP profile ↗
ORCID search ↗
×1
Chengyi Ju
DBLP profile ↗
ORCID search ↗
×1
Papers
A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus
ACL 2026
·
Guoxi Zhang
DBLP profile ↗
ORCID search ↗
AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments
ACL 2026
·
Zhiheng Xi
DBLP profile ↗
ORCID search ↗
Benchmarking Fine-Grained Error Detection in Multimodal Reasoning
ACL 2026
·
Chi-Min Chan
DBLP profile ↗
ORCID search ↗
Omni-RewardBench: Toward a Comprehensive Evaluation of Generative Reward Models Across Modalities
ACL 2026
·
Chi-Min Chan
DBLP profile ↗
ORCID search ↗
SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning
ACL 2026
·
Lichao Wang
DBLP profile ↗
ORCID search ↗
SafeMT: Multi-turn Safety for Multimodal Language Models
ACL 2026
·
Han Zhu
DBLP profile ↗
ORCID search ↗
What, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning
AAAI 2026
·
Yujin Zhou
DBLP profile ↗
ORCID search ↗
When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning
ACL 2026
·
Sitong Fang
DBLP profile ↗
ORCID search ↗
A Survey of LLM-based Agents in Medicine: How far are we from Baymax?
ACL 2025
·
Wenxuan Wang
DBLP profile ↗
ORCID search ↗
Benchmarking Multi-National Value Alignment for Large Language Models
ACL 2025
·
Chengyi Ju
DBLP profile ↗
ORCID search ↗
Boosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA
ACL 2025
·
Chi-Min Chan
DBLP profile ↗
ORCID search ↗
FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
ACL 2025
·
Junyu Luo
DBLP profile ↗
ORCID search ↗
Generative RLHF-V: Learning Principles from Multi-modal Human Preference
NeurIPS 2025
·
Jiayi Zhou
DBLP profile ↗
ORCID search ↗
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
NeurIPS 2025
·
Boyuan Chen
DBLP profile ↗
ORCID search ↗
Language Models Resist Alignment: Evidence From Data Compression
ACL 2025
·
Jiaming Ji
LegalReasoner: Step-wised Verification-Correction for Legal Judgment Reasoning
ACL 2025
·
Weijie Shi
DBLP profile ↗
ORCID search ↗
PHYBench: Holistic Evaluation of Physical Perception and Reasoning in Large Language Models
NeurIPS 2025
·
Shi Qiu
DBLP profile ↗
ORCID search ↗
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
ACL 2025
·
Jiaming Ji
Reward Generalization in RLHF: A Topological Perspective
ACL 2025
·
Tianyi Alex Qiu
DBLP profile ↗
ORCID search ↗
SAE-V: Interpreting Multimodal Models for Enhanced Alignment
ICML 2025
·
Hantao Lou
DBLP profile ↗
ORCID search ↗
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
NeurIPS 2025
·
Jiaming Ji
SafeLawBench: Towards Safe Alignment of Large Language Models
ACL 2025
·
Chuxue Cao
DBLP profile ↗
ORCID search ↗
SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning
NeurIPS 2025
·
Borong Zhang
DBLP profile ↗
ORCID search ↗
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
AAAI 2025
·
Jiayi Zhou
DBLP profile ↗
ORCID search ↗
Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction
AAAI 2025
·
Hantao Lou
DBLP profile ↗
ORCID search ↗
Aligner: Efficient Alignment by Learning to Correct
NeurIPS 2024
·
Jiaming Ji
ProgressGym: Alignment with a Millennium of Moral Progress
NeurIPS 2024
·
Tianyi Qiu
DBLP profile ↗
ORCID search ↗
Safe RLHF: Safe Reinforcement Learning from Human Feedback
ICLR 2024
·
Josef Dai
DBLP profile ↗
ORCID search ↗
SafeDreamer: Safe Reinforcement Learning with World Models
ICLR 2024
·
Weidong Huang
DBLP profile ↗
ORCID search ↗
SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
NeurIPS 2024
·
Juntao Dai
DBLP profile ↗
ORCID search ↗