PPaperPicks

Kai Chen

24 papers at tracked venues · 21 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AEQ-Bench: Measuring Empathy of Omni-Modal Large Models
  2. BadminSense: Enabling Fine-Grained Badminton Strokes Evaluation on Single Smartwatch
  3. ComfyFlow: Benchmarking LLMs for AIGC Workflow Generation
  4. Enhancing Zero-Shot Time Series Forecasting in Off-the-Shelf LLMs via Noise Injection Prompting
  5. League of LLMs: A Benchmark-Free Paradigm for Mutual Evaluation of Large Language Models
  6. STELLA: A Multimodal LLM for Protein Functional Annotation via Unified Sequence-Structure Encoding
  7. When Safety Alignment Fails to Generalize: Probing with Language Game Jailbreaks
  8. Are Your LLMs Capable of Stable Reasoning?
  9. Benchmarking Differentially Private Tabular Data Synthesis: [Experiments & Analysis]
    SIGMOD 2025 · Kai Chen
  10. CryoGEN: Generative Energy-based Models for Cryogenic Electron Tomography Reconstruction
  11. EMOVA: Empowering Language Models to See, Hear and Speak with Vivid Emotions
    CVPR 2025 · Kai Chen
  12. MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
  13. NTIRE 2025 Challenge on Short-form UGC Video Quality Assessment and Enhancement: Methods and Results
  14. OOD-Barrier: Build a Middle-Barrier for Open-Set Single-Image Test Time Adaptation via Vision Language Models
  15. RepeatLeakage: Leak Prompts from Repeating as Large Language Model Is a Good Repeater
  16. STEER-BENCH: A Benchmark for Evaluating the Steerability of Large Language Models
    EMNLP 2025 · Kai Chen
  17. SocialMOIF: Multi-Order Intention Fusion for Pedestrian Trajectory Prediction
    CVPR 2025 · Kai Chen
  18. Sparse Meets Dense: Unified Generative Recommendations with Cascaded Sparse-Dense Representations
  19. Everything2Motion: Synchronizing Diverse Inputs via a Unified Framework for Human Motion Synthesis
  20. How Susceptible are Large Language Models to Ideological Manipulation?
    EMNLP 2024 · Kai Chen
  21. LLM-REDIAL: A Large-Scale Dataset for Conversational Recommender Systems Created from User Behaviors with LLMs
  22. STAIR: Spatial-Temporal Reasoning with Auditable Intermediate Results for Video Question Answering
  23. Safer-Instruct: Aligning Language Models with Automated Preference Data
  24. UVEB: A Large-scale Benchmark and Baseline Towards Real-World Underwater Video Enhancement