PPaperPicks

Nancy F. Chen

29 papers at tracked venues · 15 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AdaMCoT: Rethinking Cross-Lingual Factual Reasoning Through Adaptive Multilingual Chain-of-Thought
  2. BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
  3. Can Persona-Prompted LLMs Emulate Subgroup Values? An Empirical Analysis of Generalisability and Fairness in Cultural Alignment
  4. MMAC: A Multilingual, Multimodal Alignment Framework for Cultural Grounding Evaluation
  5. Programming over Thinking: Efficient and Robust Multi-Constraint Planning
  6. AudioBench: A Universal Benchmark for Audio Large Language Models
  7. Benchmarking Contextual and Paralinguistic Reasoning in Speech-LLMs: A Case Study with In-the-Wild Data
  8. Beyond In-Context Learning: Aligning Long-form Generation of Large Language Models via Task-Inherent Attribute Guidelines
  9. CoinMath: Harnessing the Power of Coding Instruction for Math LLM
  10. Distilling a speech and music encoder with task arithmetic
  11. LLMs Are Biased Towards Output Formats! Systematically Evaluating and Mitigating Output Format Bias of LLMs
  12. MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues
  13. MERaLiON-AudioLLM: Advancing Speech and Language Understanding for Singapore
  14. Persuasion Dynamics in LLMs: Investigating Robustness and Adaptability in Knowledge and Safety with DuET-PD
  15. Preference Optimization for Reasoning with Pseudo Feedback
  16. Reinforcing Compositional Retrieval: Retrieving Step-by-Step for Composing Informative Contexts
  17. SingaKids: A Multilingual Multimodal Dialogic Tutor for Language Learning
  18. What Makes a Good Natural Language Prompt?
  19. Dataset-Distillation Generative Model for Speech Emotion Recognition
  20. Discursive Socratic Questioning: Evaluating the Faithfulness of Language Models' Understanding of Discourse Relations
  21. Exploring Self-supervised Logic-enhanced Training for Large Language Models
  22. In2Core: Leveraging Influence Functions for Coreset Selection in Instruction Finetuning of Large Language Models
  23. Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing
  24. Multi-expert Prompting Improves Reliability, Safety and Usefulness of Large Language Models
  25. On Context Utilization in Summarization with Large Language Models
  26. Personality-aware Student Simulation for Conversational Intelligent Tutoring Systems
  27. Prompt Optimization via Adversarial In-Context Learning
  28. Resilience of Large Language Models for Noisy Instructions
  29. SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural Reasoning