PPaperPicks

Hung Le

Deakin University, Applied Artificial Intelligence Institute, Geelong, Australia

22 papers at tracked venues · 7 at CORE A* · active 20242026

Venues

Frequent coauthors

Papers

  1. Do Domain-specific Experts exist in MoE-based LLMs?
  2. Probabilities Are All You Need: A Probability-Only Approach to Uncertainty Estimation in Large Language Models
  3. SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
  4. Accelerating Long-Term Molecular Dynamics with Physics-Informed Time-Series Forecasting
    ICDM 2025 · Hung Le
  5. Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer
  6. DmC: Nearest Neighbor Guidance Diffusion Model for Offline Cross-Domain Reinforcement Learning
  7. Dynamic Steering With Episodic Memory For Large Language Models
  8. Fair Domain Generalization with Heterogeneous Sensitive Attributes Across Domains
  9. Federated Domain Generalization with Latent Space Inversion
  10. Hybrid Cross-Domain Robust Reinforcement Learning
  11. Multi-Reference Preference Optimization for Large Language Models
    AAAI 2025 · Hung Le
  12. Navigating Social Dilemmas with LLM-based Agents via Consideration of Future Consequences
  13. Navigating Social Dilemmas with LLM-based Agents via Consideration of Future Consequences
  14. Rapid Selection and Ordering of In-Context Demonstrations via Prompt Embedding Clustering
  15. Sample Efficient Alignment Learning With Episodic Control
  16. SimSMoE: Toward Efficient Training Mixture of Experts via Solving Representational Collapse
  17. Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement Learning
    ICLR 2025 · Hung Le
  18. Beyond Surprise: Improving Exploration Through Surprise Novelty
    AAMAS 2024 · Hung Le
  19. Diversifying Training Pool Predictability for Zero-shot Coordination: A Theory of Mind Approach
  20. Large Language Model Prompting with Episodic Memory
  21. Revisiting the Dataset Bias Problem from a Statistical Perspective
  22. Variable-Agnostic Causal Exploration for Reinforcement Learning