PPaperPicks

Jian Wang

13 papers at tracked venues · 11 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Finding RELIEF: Shaping Reasoning Behavior without Reasoning Supervision via Belief Engineering
  2. Foresight Optimization for Strategic Reasoning in Large Language Models
  3. OptScale: Probabilistic Optimality for Inference-time Scaling
  4. Seeing Isn't Believing: Mitigating Belief Inertia via Active Intervention in Embodied Agents
  5. Where and What: Reasoning Dynamic and Implicit Preferences in Situated Conversational Recommendation
  6. Benchmarking for Domain-Specific LLMs: A Case Study on Academia and Beyond
  7. STeCa: Step-level Trajectory Calibration for LLM Agent Learning
  8. Towards Harmless Multimodal Assistants with Blind Preference Optimization
  9. Why Safeguarded Ships Run Aground? Aligned Large Language Models' Safety Mechanisms Tend to Be Anchored in The Template Region
  10. Cooper: Coordinating Specialized Agents towards a Complex Dialogue Goal
  11. E²CL: Exploration-based Error Correction Learning for Embodied Agents
  12. Instruct Once, Chat Consistently in Multiple Rounds: An Efficient Tuning Framework for Dialogue
    ACL 2024 · Jian Wang
  13. SCREEN: A Benchmark for Situated Conversational Recommendation