PPaperPicks

Hongyu Lin

60 papers at tracked venues · 47 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. AI-Salesman: Towards Reliable Large Language Model Driven Telemarketing
  2. Across Programming Language Silos: A Study on Cross-Lingual Retrieval-Augmented Code Generation
  3. All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG
  4. Answer First, Evidence Second? Uncovering Hidden Risks in Well-Structured AI Search Summaries
  5. DeepPresenter: Environment-Grounded Reflection for Agentic Presentation Generation
  6. Does Question Really Matter? The Attribution of Answer Bias in LLM Evaluation
  7. Expanding the Boundaries of Vision Prior Knowledge in Multi-modal Large Language Models
  8. Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning
  9. LEAP: LLM-Enhanced E-commerce Demand Prediction under Emergent Events
  10. MemSearcher: Iterative Memory Integration for Search Agent via End-to-End Reinforcement Learning
  11. Navigating the Infinite Dynamic Web Space: Effective In-Context Exploration via Cognitive Multi-Agent Collaboration
  12. On the Editability of Delta Parameters in Post-Trained Models
  13. PaperRegister: Boosting Flexible-grained Paper Search via Hierarchical Register Indexing
  14. ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models
  15. When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models
  16. A Fraudulent Blind Shipment Detection Framework in Logistics
    SIGKDD 2025 · Hongyu Lin
  17. ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
  18. AutoAlign: Get Your LLM Aligned with Minimal Annotations
  19. CRUXEVAL-X: A Benchmark for Multilingual Code Reasoning, Understanding and Execution
  20. Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
  21. Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning
  22. ConsistentChat: Building Skeleton-Guided Consistent Multi-Turn Dialogues for Large Language Models from Scratch
  23. Critic-CoT: Boosting the Reasoning Abilities of Large Language Model via Chain-of-Thought Critic
  24. DBCopilot: Natural Language Querying over Massive Databases via Schema Routing
  25. DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
  26. DeepSolution: Boosting Complex Engineering Solution Design via Tree-based Exploration and Bi-point Thinking
  27. Fraudulent Delivery Detection with Multimodal Courier Behavior Data in Last-Mile Delivery
  28. Large Language Models Often Say One Thing and Do Another
  29. Memorizing is Not Enough: Deep Knowledge Injection Through Reasoning
  30. On-Policy Self-Alignment with Fine-grained Knowledge Feedback for Hallucination Mitigation
  31. PPTAgent: Generating and Evaluating Presentations Beyond Text-to-Slides
  32. READoc: A Unified Benchmark for Realistic Document Structured Extraction
  33. RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
  34. Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?
  35. Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
  36. ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
  37. ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers
  38. Sparse Latents Steer Retrieval-Augmented Generation
  39. StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
  40. Teach Small Models to Reason by Curriculum Distillation
  41. The Linguistic Connectivities Within Large Language Models
  42. The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model
  43. Transferable Post-training via Inverse Value Learning
  44. A Behavior-aware Cause Identification Framework for Order Cancellation in Logistics Service
  45. Base of RoPE Bounds Context Length
  46. Benchmarking Large Language Models in Retrieval-Augmented Generation
  47. Chain-of-Rewrite: Aligning Question and Documents for Open-Domain Question Answering
  48. Debiasing In-Context Learning by Instructing LLMs How to Follow Demonstrations
  49. Learning or Self-aligning? Rethinking Instruction Fine-tuning
  50. Mitigating Large Language Model Hallucinations via Autonomous Knowledge Graph-Based Retrofitting
  51. Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation
  52. Open Grounded Planning: Challenges and Benchmark Construction
  53. REInstruct: Building Instruction Data from Unlabeled Corpus
  54. Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
  55. Seg2Act: Global Context-aware Action Generation for Document Logical Structuring
  56. Self-Retrieval: End-to-End Information Retrieval with One Large Language Model
  57. SoFA: Shielded On-the-fly Alignment via Priority Rule Following
  58. Spiral of Silence: How is Large Language Model Killing Information Retrieval? - A Case Study on Open Domain Question Answering
  59. StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
  60. XMC-Agent : Dynamic Navigation over Scalable Hierarchical Index for Incremental Extreme Multi-label Classification