PPaperPicks

Kam-Fai Wong

Chinese University of Hong Kong

48 papers at tracked venues · 27 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. EventWeave: A Dynamic Framework for Capturing Core and Supporting Events in Dialogue Systems
  2. Guaranteeing Knowledge Integration with Joint Decoding for Retrieval-Augmented Generation
  3. MemGuide: Intent-Driven Memory Selection for Goal-Oriented Multi-Session LLM Agents
  4. Mitigating Context Interference for Reliable and Efficient Search Agents
  5. Robust Tool Use via Fission-GRPO: Learning to Recover from Execution Errors
  6. Understanding and Mitigating Bias Inheritance in LLM-based Data Augmentation on Downstream Tasks
  7. WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models
  8. A Comprehensive Evaluation on Event Reasoning of Large Language Models
  9. A New Formula for Sticker Retrieval: Reply with Stickers in Multi-Modal and Multi-Session Conversation
  10. COPR: Continual Human Preference Learning via Optimal Policy Regularization
  11. Centrality-guided Pre-training for Graph
  12. Chain-of-Probe: Examining the Necessity and Accuracy of CoT Step-by-Step
  13. CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and Compatibility
  14. Do Mentioned Items Truly Matter? Enhancing Conversational Recommender Systems with Causal Intervention and Large Language Models
  15. Flexibly Utilize Memory for Long-Term Conversation via a Fragment-then-Compose Framework
  16. Instance Relation Learning Network with Label Knowledge Propagation for Few-shot Multi-label Intent Detection
  17. Learning First-Order Logic Rules for Argumentation Mining
  18. MemeReaCon: Probing Contextual Meme Understanding in Large Vision-Language Models
  19. MiniMax-Remover: Taming Bad Noise Helps Video Object Removal
  20. Mitigating Biases of Large Language Models in Stance Detection with Counterfactual Augmented Calibration
  21. MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models
  22. PEARL: Towards Permutation-Resilient LLMs
  23. ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning
  24. Rethinking Stateful Tool Use in Multi-Turn Dialogues: Benchmarks and Challenges
  25. Selective Forgetting: Advancing Machine Unlearning Techniques and Evaluation in Language Models
  26. Self-DC: When to Reason and When to Act? Self Divide-and-Conquer for Compositional Unknown Questions
  27. Self-Reasoning Language Models: Unfold Hidden Reasoning Chains with Few Reasoning Catalyst
  28. Señorita-2M: A High-Quality Instruction-based Dataset for General Video Editing by Video Specialists
  29. Steering Knowledge Selection Behaviours in LLMs via SAE-Based Representation Engineering
  30. Stepwise Reasoning Checkpoint Analysis: A Test Time Scaling Method to Enhance LLMs' Reasoning
  31. T2: An Adaptive Test-Time Scaling Strategy for Contextual Question Answering
  32. ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
  33. UAlign: Leveraging Uncertainty Estimations for Factuality Alignment on Large Language Models
  34. Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning
  35. AppBench: Planning of Multiple APIs from Various APPs for Complex User Instruction
  36. DPDLLM: A Black-box Framework for Detecting Pre-training Data from Large Language Models
  37. Empowering Large Language Models: Tool Learning for Real-World Interaction
  38. Enhancing Large Language Models Against Inductive Instructions with Dual-critique Prompting
  39. LLMEdgeRefine: Enhancing Text Clustering with LLM-Based Boundary Point Refinement
  40. M4LE: A Multi-Ability Multi-Range Multi-Task Multi-Domain Long-Context Evaluation Benchmark for Large Language Models
  41. MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
  42. Multi-modal Stance Detection: New Datasets and Model
  43. Role Prompting Guided Domain Adaptation with General Capability Preserve for Large Language Models
  44. SELF-GUARD: Empower the LLM to Safeguard Itself
  45. SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
  46. VLEU: a Method for Automatic Evaluation for Generalizability of Text-to-Image Models
  47. Visually Guided Generative Text-Layout Pre-training for Document Intelligence
  48. WatME: Towards Lossless Watermarking Through Lexical Redundancy