#stablebaselines3 — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #stablebaselines3, aggregated by home.social.
-
Создаем собственные окружения в Reinforcement Learning
Готовые RL‑окружения удобны для старта, но в реальных задачах редко хватает чужих правил и бенчмарков. В статье разбираем, как создать собственную среду для обучения с подкреплением: задать действия и наблюдения, продумать функцию награды и не сломать обучение на базовых ошибках.
https://habr.com/ru/companies/otus/articles/1052116/
#обучение_с_подкреплением #Reinforcement_Learning #RL #кастомные_окружения #Gymnasium #OpenAI_Gym #StableBaselines3 #агент #функция_награды #пространство_действий