JA EN

#hyperband

1 記事

01 ·深層学習の基礎·★ 会員·論文·17分で読めます ハイパーパラメータ探索 — 勘・グリッド・ベイズ最適化 Random Search for Hyper-Parameter Optimization 学習率やバッチサイズは勾配が教えてくれないので、探すしかありません。なぜグリッドサーチが弱いのか、探索空間を対数で切る理由、ベイズ最適化の獲得関数が何を数えているのか、早期打ち切りが探索アルゴリズムより効く理由を、Optunaのコードと現場の落とし穴まで含めて前提知識ゼロから解説します。