PPaperPicks

Xianpei Han

57 papers at tracked venues · 46 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AI-Salesman: Towards Reliable Large Language Model Driven Telemarketing
  2. Across Programming Language Silos: A Study on Cross-Lingual Retrieval-Augmented Code Generation
  3. All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
  4. Answer First, Evidence Second? Uncovering Hidden Risks in Well-Structured AI Search Summaries
  5. CoCoNUTS: Concentrating on Content while Neglecting Uninformative Textual Styles for AI-Generated Peer Review Detection
  6. DeepPresenter: Environment-Grounded Reflection for Agentic Presentation Generation
  7. Does Question Really Matter? The Attribution of Answer Bias in LLM Evaluation
  8. Expanding the Boundaries of Vision Prior Knowledge in Multi-modal Large Language Models
  9. Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning
  10. MemSearcher: Iterative Memory Integration for Search Agent via End-to-End Reinforcement Learning
  11. Navigating the Infinite Dynamic Web Space: Effective In-Context Exploration via Cognitive Multi-Agent Collaboration
  12. On the Editability of Delta Parameters in Post-Trained Models
  13. PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
  14. ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models
  15. When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
  16. ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
  17. AutoAlign: Get Your LLM Aligned with Minimal Annotations
  18. CRUXEVAL-X: A Benchmark for Multilingual Code Reasoning, Understanding and Execution
  19. Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
  20. ConsistentChat: Building Skeleton-Guided Consistent Multi-Turn Dialogues for Large Language Models from Scratch
  21. Critic-CoT: Boosting the Reasoning Abilities of Large Language Model via Chain-of-Thought Critic
  22. DBCopilot: Natural Language Querying over Massive Databases via Schema Routing
  23. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
  24. DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking
  25. Large Language Models Often Say One Thing and Do Another
  26. Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
  27. On-Policy Self-Alignment with Fine-grained Knowledge Feedback for Hallucination Mitigation
  28. PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
  29. READoc: A Unified Benchmark for Realistic Document Structured Extraction
  30. RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
  31. Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?
  32. Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
  33. ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
  34. ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers
  35. Sparse Latents Steer Retrieval-Augmented Generation
  36. StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
  37. Teach Small Models to Reason by Curriculum Distillation
  38. The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward Models
  39. The Linguistic Connectivities Within Large Language Models
  40. The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model
  41. Transferable Post-training via Inverse Value Learning
  42. Base of RoPE Bounds Context Length
  43. Benchmarking Large Language Models in Retrieval-Augmented Generation
  44. Chain-of-Rewrite: Aligning Question and Documents for Open-Domain Question Answering
  45. Debiasing In-Context Learning by Instructing LLMs How to Follow Demonstrations
  46. Learning or Self-aligning? Rethinking Instruction Fine-tuning
  47. Mitigating Large Language Model Hallucinations via Autonomous Knowledge Graph-Based Retrofitting
  48. Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation
  49. Open Grounded Planning: Challenges and Benchmark Construction
  50. REInstruct: Building Instruction Data from Unlabeled Corpus
  51. Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
  52. Seg2Act: Global Context-aware Action Generation for Document Logical Structuring
  53. Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
  54. SoFA: Shielded On-the-fly Alignment via Priority Rule Following
  55. Spiral of Silence: How is Large Language Model Killing Information Retrieval? - A Case Study on Open Domain Question Answering
  56. StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
  57. XMC-Agent : Dynamic Navigation over Scalable Hierarchical Index for Incremental Extreme Multi-label Classification