PPaperPicks

Lukas Galke

6 papers at tracked venues · 3 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. DeToNATION: Decoupled Torch Network-Aware Training on Interlinked Online Nodes
  2. Training Language Models to Use Prolog as a Tool
  3. Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
  4. Guarded Query Routing for Large Language Models
  5. Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
  6. RADAr: A Transformer-Based Autoregressive Decoder Architecture for Hierarchical Text Classification