強化学習を使用して、カートの上にある棒のバランスをとるモデルを訓練します。.
Description
この例では、TensorFlow.jsを使用して簡単なタスクを実行する方法を紹介します。 reinforcement learning (RL). 特に、TensorFlow.jsでのpolicy-gradientメソッドの実装を示しています。 この実装は、古典的なカートポール制御の問題を解決します。
自分で活動を通じて、エージェントはできるだけ多くのステップの間に棒のバランスをとる方法を学びます。
使用方法
状態
モデル初期化
トレーニングパラメータ
トレーニング過程
シミュレーション