Небольшой апдейт по студии https://github.com/researchim-ai/reinforcement-studio туда добавлены некоторые multi agent rl алгоритмы world models и алгоритмы которые с ними работают efficient zero v2 (на скрине тренится на одной из задач nethack куча енвов все пока в процессе тестов и отладки) Кстати покидайте енвы которые вы хотели бы видеть внутри в комментарии PS проекты делаются тут https://t.me/researchim