RMSprop

Adaptive learning rate optimization algorithm using moving average of squared gradients.

In italiano: RMSprop

Divides learning rate by exponential moving average of squared gradients. Addresses Adagrad's diminishing learning rates. Good for RNNs and non-stationary problems.

Examples

  • RNN training
  • Non-convex optimization
  • Adaptive learning