PPO

2020-10-18

ハムスターでもわかるProximal Policy Optimization （PPO）①基本編

強化学習 tensorflow2 PPO

シンプルなようで厄介な強化学習アルゴリズム PPO (Proximal Policy Optimization) を実装レベルの細かいテクニックまで含めて解説します。 ※TRPOの理解が前提です horomary.hatenablog.com [PPOシリーズ] ハムスターでもわかるProximal Policy Optimization…

どこから見てもメンダコ

軟体動物門頭足綱八腕類メンダコ科

PPO

ハムスターでもわかるProximal Policy Optimization （PPO）①基本編