Похожие презентации:
Reinforcementlearning1
1. Reinforcement Learning. Основы и марковский процесс
Красников Н.С.2. Определение
Обучение с подкреплением - это вычислительный подход кпониманию и автоматизации целенаправленного обучения и
принятия решений. Он отличается от других вычислительных
подходов тем, что делает акцент на обучении агента на основе
прямого взаимодействия с окружающей средой, не требуя
примерного наблюдения или полных моделей окружающей
среды
2
3. Основная концепция
O – данные из внешнейсреды
(ее состояние)
А – множество действий
агента
R – награда за переход в
следующее состояние
3
4. Агент в обучении с подкреплением
На шаге t:• Агент выполняет
действие