Q-learning
Q-learning — это алгоритм обучения с подкреплением, который учит агента выбирать оптимальные действия на основе наград.
Что это такое
Алгоритм оценивает «ценность» действий в разных состояниях с помощью Q-функции. Со временем агент обучается принимать решения, максимизируя суммарную награду.
Особенности
- обучение через награды
- использует Q-функцию
- не требует модели среды
- применяется в reinforcement learning
Связанные термины
Reinforcement Learning
Data Mining
Machine Learning