PPaperPicks

Yanghua Xiao

89 papers at tracked venues · 59 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. ADaPT: Token-Level Decoupling for Efficient Large Reasoning Models
  2. Adaptive Hallucination Alleviation in Multimodal Large Language Models: From Strategic Data Selection to Severity-Guided Training
  3. Are Large Language Models Reliable Reviewers? A Benchmark for Error Detection in Financial Documents
  4. Can LLMs Learn to Map the World from Local Descriptions?
  5. Code LLMs Still Fall Short of Top Programmers: Evaluating Algorithmic Code Generation Through Computational Thinking
  6. Difficulty Is Not Enough: Curriculum Learning for LLMs Fine-tuning Must Consider Utility
  7. Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts
  8. HER: Human-like Reasoning and Reinforcement Learning for LLM Role-playing
  9. HumanLLM: Benchmarking and Improving LLM Anthropomorphism via Human Cognitive Patterns
  10. Immediate Inference: The Missing Foundation in Large Language Model Logical Reasoning
  11. InsLogicBench: An Argumentation Logic Grounded Benchmark for Complex Insurance Claims Adjudication
  12. Instructions are all you need: Self-supervised Reinforcement Learning for Instruction Following
  13. Large Language Model Judged Self-Training for Named Entity Recognition
  14. MMIFEvol: Towards Evolutionary Multimodal Instruction Following
  15. Measuring the Unmeasurable: Unveiling Latent Cognitive Capabilities of LLM
  16. Memory-Guided Hard Data Augmentation for Multimodal Named Entity Recognition
  17. Metaphor Reasoning is Meta-reasoning
  18. Outcome-Grounded Advantage Reshaping for Fine-Grained Credit Assignment in Mathematical Reasoning
  19. The "Knowledge-Behavior Gap" in Cultural Taboo Safety of Large Language Models
  20. The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
  21. What Makes an Ideal Quote? Recommending "Unexpected yet Rational" Quotations via Novelty
  22. Why Did Apple Fall: Evaluating Curiosity in Large Language Models
  23. ARIA: Training Language Agents with Intention-driven Reward Aggregation
  24. ARM: Adaptive Reasoning Model
  25. Accelerated Evolving Set Processes for Local PageRank Computation
  26. Attributive Reasoning for Hallucination Diagnosis of Large Language Models
  27. BOOKWORLD: From Novels to Interactive Agent Societies for Story Creation
  28. Bridging the Unseen Gap: Label-Enhanced Information Bottleneck Distillation for Multimodal Named Entity Recognition
  29. CDS: Data Synthesis Method Guided by Cognitive Diagnosis Theory
  30. CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
  31. Character is Destiny: Can Persona-assigned Language Models Make Personal Choices?
  32. CoSER: Coordinating LLM-Based Persona Simulation of Established Roles
  33. Curse of Knowledge: Your Guidance and Provided Knowledge are biasing LLM Judges in Complex Evaluation
  34. DEEPER Insight into Your User: Directed Persona Refinement for Dynamic Persona Modeling
  35. Data-Efficient Selection via Grammatical Complexity in Continual Pre-training of Domain-Specific LLMs
  36. Dialect-SQL: An Adaptive Framework for Bridging the Dialect Gap in Text-to-SQL
  37. Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective
  38. From Remembering to Metacognition: Do Existing Benchmarks Accurately Evaluate LLMs?
  39. GAPO: Learning Preferential Prompt through Generative Adversarial Policy Optimization
  40. Ground Every Sentence: Improving Retrieval-Augmented LLMs with Interleaved Reference-Claim Generation
  41. KUG: Joint Enhancement of Internal and External Knowledge for Retrieval-Augmented Generation
  42. Logical Consistency is Vital: Neural-Symbolic Information Retrieval for Negative-Constraint Queries
  43. MCiteBench: A Multimodal Benchmark for Generating Text with Citations
  44. MultiLingPoT: Boosting Mathematical Reasoning in LLMs through Multilingual Program Integration
  45. Order Doesn't Matter, But Reasoning Does: Training LLMs with Order-Centric Augmentation
  46. Order Matters: Investigate the Position Bias in Multi-constraint Instruction Following
  47. Past Meets Present: Creating Historical Analogy with Large Language Models
  48. Revealing the Barriers of Language Agents in Planning
  49. SELFGOAL: Your Language Agents Already Know How to Achieve High-level Goals
  50. Skeletons Matter: Dynamic Data Augmentation for Text-to-Query
  51. Step-by-Step Mastery: Enhancing Soft Constraint Following Ability of Large Language Models
  52. StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
  53. Think Thrice Before You Act: Progressive Thought Refinement in Large Language Models
  54. ANALOGYKB: Unlocking Analogical Reasoning of Language Models with A Million-scale Knowledge Base
  55. AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
  56. Beyond Entities: A Large-Scale Multi-Modal Knowledge Graph with Triplet Fact Grounding
  57. CONSTRUCTURE: Benchmarking CONcept STRUCTUre REasoning for Multimodal Large Language Models
  58. CR-LLM: A Dataset and Optimization for Concept Reasoning of Large Language Models
  59. Can Large Language Models Understand Real-World Complex Instructions?
  60. Capturing Minds, Not Just Words: Enhancing Role-Playing Language Models with Personality-Indicative Data
  61. DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
  62. Do Large Language Models have Problem-Solving Capability under Incomplete Information Scenarios?
  63. Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
  64. ESC-Eval: Evaluating Emotion Support Conversations in Large Language Models
  65. EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
  66. Empowering Biomedical Named Entity Recognition through Multi-Tagger Collaboration
  67. Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
  68. Exploiting Duality in Open Information Extraction with Predicate Prompt
  69. Faster Local Solvers for Graph Diffusion Equations
  70. From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models
  71. GeoAgent: To Empower LLMs using Geospatial Tools for Address Standardization
  72. GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick
  73. HOTVCOM: Generating Buzzworthy Comments for Videos
  74. InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews
  75. Is There a One-Model-Fits-All Approach to Information Extraction? Revisiting Task Definition Biases
  76. Iterative Methods via Locally Evolving Set Process
  77. Light Up the Shadows: Enhance Long-Tailed Entity Grounding with Concept-Guided Vision-Language Models
  78. M2ConceptBase: A Fine-Grained Aligned Concept-Centric Multimodal Knowledge Base
  79. Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
  80. SEGMENT+: Long Text Processing with Short-Context Language Models
  81. Small Language Model Can Self-Correct
  82. Source Prompt: Coordinated Pre-training of Language Models on Diverse Corpora from Multiple Sources
  83. Talk Funny! A Large-Scale Humor Response Dataset with Chain-of-Humor Interpretation
  84. TemporalMed: Advancing Medical Dialogues with Time-Aware Responses in Large Language Models
  85. TimeArena: Shaping Efficient Multitasking Language Agents in a Time-Aware Simulation
  86. Translate Meanings, Not Just Words: IdiomKB's Role in Optimizing Idiomatic Translation with Language Models
  87. TravelPlanner: A Benchmark for Real-World Planning with Language Agents
  88. XMeCap: Meme Caption Generation with Sub-Image Adaptability
  89. Xiezhi: An Ever-Updating Benchmark for Holistic Domain Knowledge Evaluation