目次 先日の迷路問題について迷路が変動するような環境下でもゴールを目指せるエージェントの構築を検討していきます。 今回はまず、画像入力のTransformerモデルでDDQNで迷路環境の学習が可能かの検証を行っていきます。 本日テーマ: DDQN×画像入力のTransformerにより静的迷路のゴールが出来るか確認 🎵 BGMを再生する 前回記事:前回行ったことは以下記事をご参照ください yoshishinnze.hatenablog.com DDQNについて まずは今回利用する予定の強化学習アルゴリズムであるDDQNとはどんなアルゴリズムであるかについて説明を行います。 DDQN(Doubl…