trpo.
Продвинутые RL алгоритмы: NPG, TRPO, PPO
Продолжение постов про RL:1) Intro Reinforcement Learning2) Reinforcement Learning: Model-free & Deep RL3) Reinforcement Learning: Policy gradient methods
«Принять или отвергнуть? – вот в чем вопрос»
Умение видеть главное и особенности
Упражнение 5. Визуальная концентрация
Основные принципы запоминания лиц
Продолжение постов про RL:1) Intro Reinforcement Learning2) Reinforcement Learning: Model-free & Deep RL3) Reinforcement Learning: Policy gradient methods