見出し画像

Gymで強化学習㉕Double DQN:理論編

2023年6月25日 20:26

前回は、DQNを使って月面着陸の環境に挑戦しました。今回は、Double DQNを解説します。

DeepMindは2013年にDQNを発表しまたしたが、その2年後の2015年にDouble DQNの論文を発表しています。

この論文によって、DQNにどのような改良が加えられたのでしょうか。そもそも、DQNにはどのような問題があったのでしょうか。また、その解決方法はどのようなものでしょうか。

これらについて解説します。

ここから先は

8,753字 / 5画像

キカベン・読み放題

¥1,000 / 月

初月無料

人工知能、機械学習、ディープラーニング関連の用語説明、研究論文の概要、プログラミングの具体例などの読み応えのある新しい記事が月に４−５本ほど追加されます。また、気になるAIニュースや日常の雑観などは随時公開しています。

メンバー限定の会員証が発行されます
活動期間に応じたバッジを表示
メンバー限定掲示板を閲覧できます
メンバー特典記事を閲覧できます
メンバー特典マガジンを閲覧できます

このメンバーシップの詳細

この記事が気に入ったらサポートをしてみませんか？