PPaperPicks

Yaojie Lu

Institute of Software, Chinese Academy of Sciences, China

47 papers at tracked venues · 38 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AI-Salesman: Towards Reliable Large Language Model Driven Telemarketing
  2. Across Programming Language Silos: A Study on Cross-Lingual Retrieval-Augmented Code Generation
  3. All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
  4. Answer First, Evidence Second? Uncovering Hidden Risks in Well-Structured AI Search Summaries
  5. DeepPresenter: Environment-Grounded Reflection for Agentic Presentation Generation
  6. Expanding the Boundaries of Vision Prior Knowledge in Multi-modal Large Language Models
  7. Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning
  8. MemSearcher: Iterative Memory Integration for Search Agent via End-to-End Reinforcement Learning
  9. Navigating the Infinite Dynamic Web Space: Effective In-Context Exploration via Cognitive Multi-Agent Collaboration
  10. On the Editability of Delta Parameters in Post-Trained Models
  11. PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
  12. ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models
  13. When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
  14. AutoAlign: Get Your LLM Aligned with Minimal Annotations
  15. CRUXEVAL-X: A Benchmark for Multilingual Code Reasoning, Understanding and Execution
  16. Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
  17. ConsistentChat: Building Skeleton-Guided Consistent Multi-Turn Dialogues for Large Language Models from Scratch
  18. Critic-CoT: Boosting the Reasoning Abilities of Large Language Model via Chain-of-Thought Critic
  19. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
  20. DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking
  21. From Informal to Formal - Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
  22. Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
  23. On-Policy Self-Alignment with Fine-grained Knowledge Feedback for Hallucination Mitigation
  24. PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
  25. READoc: A Unified Benchmark for Realistic Document Structured Extraction
  26. RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
  27. Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?
  28. Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
  29. ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
  30. ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers
  31. Sparse Latents Steer Retrieval-Augmented Generation
  32. StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
  33. Teach Small Models to Reason by Curriculum Distillation
  34. The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward Models
  35. The Linguistic Connectivities Within Large Language Models
  36. The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model
  37. Transferable Post-training via Inverse Value Learning
  38. Chain-of-Rewrite: Aligning Question and Documents for Open-Domain Question Answering
  39. Debiasing In-Context Learning by Instructing LLMs How to Follow Demonstrations
  40. Mitigating Large Language Model Hallucinations via Autonomous Knowledge Graph-Based Retrofitting
  41. Open Grounded Planning: Challenges and Benchmark Construction
  42. REInstruct: Building Instruction Data from Unlabeled Corpus
  43. Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
  44. Seg2Act: Global Context-aware Action Generation for Document Logical Structuring
  45. Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
  46. SoFA: Shielded On-the-fly Alignment via Priority Rule Following
  47. XMC-Agent : Dynamic Navigation over Scalable Hierarchical Index for Incremental Extreme Multi-label Classification