問題
深度學習中有很多優化函式,常見的那些你還記得它的定義以及優缺點嗎?
背景知識
深度學習網路訓練中,有很多可供選擇的優化函式如SGD、Adam等等,到呼叫哪個好呢?其實這個問題沒有確切的答案,優化函式是需要配合損失函式使用的,說白了,優化函式也是一種超引數,是需要嘗試的,哪個效果好就用哪個……
這些優化函式其實差別不大,都是基于一個基本框架來演進的,所以下面先介紹下優化演算法的基本框架:
1、優化演算法基本框架
(記住這個框架!!!)
假設當前時刻待優化的引數為 θ t \theta_t θ
轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/299053.html
標籤:其他
上一篇:語音助手——整體架構和設計
