Исследования
Карта алгоритмов RL: DQN, PPO, SAC и Dreamer на одной схеме
В статье на Habr представлена таксономия алгоритмов Reinforcement Learning. Простым языком разбираются ключевые модели: DQN, PPO, SAC, AlphaZero, Dreamer и другие.
Материал включает единую карту, показывающую, как эти методы связаны между собой. Это поможет не запутаться в многообразии подходов RL.
Источник: habr.com