home.social

#stablebaselines3 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #stablebaselines3, aggregated by home.social.

fetched live
  1. Создаем собственные окружения в Reinforcement Learning

    Готовые RL‑окружения удобны для старта, но в реальных задачах редко хватает чужих правил и бенчмарков. В статье разбираем, как создать собственную среду для обучения с подкреплением: задать действия и наблюдения, продумать функцию награды и не сломать обучение на базовых ошибках.

    habr.com/ru/companies/otus/art

    #обучение_с_подкреплением #Reinforcement_Learning #RL #кастомные_окружения #Gymnasium #OpenAI_Gym #StableBaselines3 #агент #функция_награды #пространство_действий