Original Summary

A Double Deep Q-Network (DDQN) reinforcement learning algorithm to train a Battlesnake agent. Several features are used to enhance the algorithm, including vectorized environments, prioritized experience replay, board canonicalization, self-play, and a Monte Carlo Tree Search.


  • 情报分类:技术学习与提效
  • 分类依据:内容涉及技术、AI、软件工具或工程实践
  • 信息来源:GitHub · AI 新项目
  • 发布时间:2026/9/27 22:32:12