Создание автономных торговых агентов на основе методов обучения с подкреплением (Reinforcement Learning)
На выходе
Проектировать окружение для обучения агентов по стандарту OpenAI Gym; Реализовывать алгоритмы обучения с подкреплением (Policy Gradient) на Python; Обучать нейронные сети принимать торговые решения вместо прогнозирования цен; Выполнять эмуляцию торговли нейросетевым агентом