Обучение агентов Reinforcement Learning на Python: от основ до Q-Learning и SARSA
На выходе
Программировать агентов обучения с подкреплением на Python; Использовать алгоритмы Q-Learning и SARSA; Применять методы динамического программирования для оптимизации стратегий; Вычислять ценность состояний и действий в неопределенных средах