P
PaperPicks
Conferences
Souradip Chakraborty
18 papers at tracked venues · 14 at CORE A* · active 2024–2026
DBLP profile ↗
ORCID search ↗
Venues
NeurIPS
×4
AAAI
×3
ICLR
×3
ICML
×3
CVPR
×1
EACL
×1
ECML-PKDD
×1
EMNLP
×1
IROS
×1
Frequent coauthors
Soumya Suvra Ghosal
DBLP profile ↗
ORCID search ↗
×2
James Beetham
DBLP profile ↗
ORCID search ↗
×1
Mucong Ding
DBLP profile ↗
ORCID search ↗
×1
Nirjhar Das
DBLP profile ↗
ORCID search ↗
×1
Prashant Trivedi
DBLP profile ↗
ORCID search ↗
×1
Mohamad Fares El Hajj Chehade
DBLP profile ↗
ORCID search ↗
×1
Michael-Andrei Panaitescu-Liess
DBLP profile ↗
ORCID search ↗
×1
Pankayaraj Pathmanathan
DBLP profile ↗
ORCID search ↗
×1
Anas Barakat
DBLP profile ↗
ORCID search ↗
×1
Xiyang Wu
DBLP profile ↗
ORCID search ↗
×1
Aakriti Agrawal
DBLP profile ↗
ORCID search ↗
×1
Xiangyu Liu
DBLP profile ↗
ORCID search ↗
×1
Papers
Jailbreaks as Inference-Time Alignment: A Framework for Understanding Safety Failures in LLMs
EACL 2026
·
James Beetham
DBLP profile ↗
ORCID search ↗
A Technical Report on "Erasing the Invisible": The 2024 NeurIPS Competition on Stress Testing Image Watermarks
NeurIPS 2025
·
Mucong Ding
DBLP profile ↗
ORCID search ↗
Active Preference Optimization for Sample Efficient RLHF
ECML-PKDD 2025
·
Nirjhar Das
DBLP profile ↗
ORCID search ↗
Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment
AAAI 2025
·
Prashant Trivedi
DBLP profile ↗
ORCID search ↗
Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
ICML 2025
·
Mohamad Fares El Hajj Chehade
DBLP profile ↗
ORCID search ↗
Can Watermarking Large Language Models Prevent Copyrighted Text Generation and Hide Training Data?
AAAI 2025
·
Michael-Andrei Panaitescu-Liess
DBLP profile ↗
ORCID search ↗
Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
ICLR 2025
·
Souradip Chakraborty
Does Thinking More Always Help? Mirage of Test-Time Scaling in Reasoning Models
NeurIPS 2025
·
Soumya Suvra Ghosal
DBLP profile ↗
ORCID search ↗
Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment
CVPR 2025
·
Soumya Suvra Ghosal
DBLP profile ↗
ORCID search ↗
Is Poisoning a Real Threat to DPO? Maybe More So Than You Think
AAAI 2025
·
Pankayaraj Pathmanathan
DBLP profile ↗
ORCID search ↗
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
NeurIPS 2025
·
Anas Barakat
DBLP profile ↗
ORCID search ↗
On the Vulnerability of LLM/VLM-Controlled Robotics
IROS 2025
·
Xiyang Wu
DBLP profile ↗
ORCID search ↗
Uncertainty-Aware Answer Selection for Improved Reasoning in Multi-LLM Systems
EMNLP 2025
·
Aakriti Agrawal
DBLP profile ↗
ORCID search ↗
MaxMin-RLHF: Alignment with Diverse Human Preferences
ICML 2024
·
Souradip Chakraborty
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback
ICLR 2024
·
Souradip Chakraborty
Position: On the Possibilities of AI-Generated Text Detection
ICML 2024
·
Souradip Chakraborty
Rethinking Adversarial Policies: A Generalized Attack Formulation and Provable Defense in RL
ICLR 2024
·
Xiangyu Liu
DBLP profile ↗
ORCID search ↗
Transfer Q-star : Principled Decoding for LLM Alignment
NeurIPS 2024
·
Souradip Chakraborty