将棋プログラムの開発
前回の開発の失敗
前に将棋のルールをまったく教えずに、自己対局で強化学習していくプログラムを作ったのですが、何日まわしてもまったく強くならず失敗してしまいました。
今回の再挑戦
前回の失敗を糧にして再挑戦します。
対策としてはモデルをCNN+トランスフォーマーからCNN一本に変更してシンプル化していきます。
少しでも強くなる姿を見てみたいです。
また続き書きます。
結果
かなり強くできました。棋力3段の私が勝てないくらいのレベルになりました。ただ、現在積んでいるGPUでは限界があるようで頭打ちになったこともあり学習を止めました。
徐々に強くなっていく将棋AIを見るのは楽しいものでした。
将棋のルールを一切与えず、将棋を強くしていくことに成功したので、次は他のボードゲームにも調整してみようと思います。

Comments