/notes/

Recent Notes

  • Diffusion Implementation

    Aug 15, 2026

    • dl
  • Reparameterized Diffusion Loss

    Aug 12, 2026

    • dl
  • Diffusion Training

    Aug 11, 2026

    • dl

See 1905 more →

Home

❯

ML

❯

Optimizing Neural Networks

Optimizing Neural Networks

Jan 28, 20241 min read

  • ml

An optimizer takes in a gradient and decides how to update the parameters based on the gradients. The simplest form is Stochastic Gradient Descent.

  • Adaptive step-size
    • Running Averages
    • Momentum (ML)
  • Adadelta
  • Adaptive moment estimation

Graph View

Created with Quartz v5.0.0 © 2026

  • Main site