PPaperPicks

Ge Li

Peking University, Key Laboratory of High Confidence Software Technologies, Bejing, China

26 papers at tracked venues · 26 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. CODERL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
  2. DAVSP: Safety Alignment for Large Vision-Language Models via Deep Aligned Visual Safety Prompt
  3. EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning for LLMs
  4. IntentCoding: Amplifying User Intent in Code Generation
  5. KoCo-Bench: Can Large Language Models Leverage Domain Knowledge in Software Development?
  6. Large Language Model Unlearning for Source Code
  7. RL-PLUS: Countering Capability Boundary Collapse of LLMs in Reinforcement Learning with Hybrid-policy Optimization
  8. Saber: Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model in Code Generation
  9. VulAgent: Hypothesis-Validation Driven Multi-Agent Architecture for Vulnerability Detection
  10. Benchmarking Long-Context Language Models on Long Code Understanding
  11. CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
  12. Dataflow-Guided Neuro-Symbolic Language Models for Type Inference
    ICML 2025 · Ge Li
  13. FAN: Fourier Analysis Networks
  14. Focused-DPO: Enhancing Code Generation Through Focused Preference Optimization on Error-Prone Points
  15. LLM-Powered Test Case Generation for Detecting Bugs in Plausible Programs
  16. Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling
  17. Recursive Transformer: Boosting Reasoning Ability with State Stack
  18. Rethinking Repetition Problems of LLMs in Code Generation
  19. SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning
  20. CodeAgent: Enhancing Code Generation with Tool-Integrated Agent Systems for Real-World Repo-level Coding Challenges
  21. DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories
  22. EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
  23. Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
  24. HiRoPE: Length Extrapolation for Code Models Using Hierarchical Position
  25. Hot or Cold? Adaptive Temperature Sampling for Code Generation with Large Language Models
  26. PACE: Improving Prompt with Actor-Critic Editing for Large Language Model