TensorFlow.js:強化学習

強化学習を使用して、カートの上にある棒のバランスをとるモデルを訓練します。.

Description

この例では、TensorFlow.jsを使用して簡単なタスクを実行する方法を紹介します。 reinforcement learning (RL). 特に、TensorFlow.jsでのpolicy-gradientメソッドの実装を示しています。 この実装は、古典的なカートポール制御の問題を解決します。

自分で活動を通じて、エージェントはできるだけ多くのステップの間に棒のバランスをとる方法を学びます。

使用方法

状態

待機中

モデル初期化

トレーニングパラメータ

トレーニングスピードを上げたい場合はチェックを外してください。

トレーニング過程

シミュレーション