知能を創る

人工知能、機械学習、深層学習のニュース記事を収集し、技術動向を調査していきます。

倒立振子で学ぶ DQN (Deep Q Network)

qiita.com

強化学習の一手法であるQ-learning とディープニューラルネットを組み合わせた Deep Q Network、通称DQNを使って倒立振子の振り上げ問題を解決してみます。

ディープニューラルネットQは状態観測結果のシーケンスを入力すると、各行動の行動価値を出力するネットです。行動価値は、今回の場合は「入力された角度シーケンスの示す状況では、モータを右、左に回すのはそれぞれ、どれぐらいうれしいか」ということを示すベクタになります。

Best ERは小さな成功にとらわれすぎてハマる場合があると思います。あとは環境の変化にも十分対応できませんね。過去の栄光にとらわれてしまうので。なんだか先ほどの黄金時代の件といい、つい人生論に重ねたくなってしまいますが、まあ、タスクによる、ということですね。

 

 

人気ホテルが最大78%OFF
200社の予約サイトから料金を一括比較
最安値の宿泊プランをご案内
www.trivago.jp

にほんブログ村 ニュースブログ ITニュースへにほんブログ村

にほんブログ村 IT技術ブログ IT技術情報へにほんブログ村