Почему обучение DDPG различается со временем при оптимизации с минимальными затратами? ⇐ Python

Программы на Python
Anonymous
Почему обучение DDPG различается со временем при оптимизации с минимальными затратами?

Сообщение Anonymous »

Каковы распространенные причины, по которым эффективность обучения со временем снижается — например, при оптимизации с минимальными затратами, но затраты продолжают расти, а вознаграждение симметрично уменьшается во время обучения? Спасибо

Подробнее здесь: https://stackoverflow.com/questions/798 ... nimum-cost

Вернуться в «Python»