PPaperPicks

Dongjin Kang

8 papers at tracked venues · 5 at CORE A* · active 20242025

Venues

Frequent coauthors

Papers

  1. One Missing Piece for Open-Source Reasoning Models: A Dataset to Mitigate Cold-Starting Short CoT LLMs in RL
  2. Rethinking Reward Model Evaluation Through the Lens of Reward Overoptimization
  3. ToolHaystack: Stress-Testing Tool-Augmented Language Models in Realistic Long-Term Interactions
  4. Web-Shepherd: Advancing PRMs for Reinforcing Web Agents
  5. Cactus: Towards Psychological Counseling Conversations using Cognitive Behavioral Theory
  6. Can Large Language Models be Good Emotional Supporter? Mitigating Preference Bias on Emotional Support Conversation
    ACL 2024 · Dongjin Kang
  7. Coffee-Gym: An Environment for Evaluating and Improving Natural Language Feedback on Erroneous Code
  8. Large Language Models Are Clinical Reasoners: Reasoning-Aware Diagnosis Framework with Prompt-Generated Rationales