Jump to content
Toggle sidebar
Marovi AI
Search
English
Personal tools
Create account
Log in
Navigation
Main page
Recent changes
Random page
Help about MediaWiki
Tools
What links here
Related changes
Special pages
Printable version
Permanent link
Page information
In other languages
Add languages
Translations
:
Gradient Descent/31/zh
Translation unit
Discussion
新加坡简体
不转换
简体
繁體
大陆简体
香港繁體
澳門繁體
大马简体
新加坡简体
臺灣正體
Read
View source
View history
More
Read
View source
View history
From Marovi AI
动量
— 从过去的梯度中累积一个速度
向量
,有助于在峡谷状的地形中加速
收敛
。
Nesterov
加速梯度
— 一种
动量
变体,在前瞻位置计算梯度,从而获得更好的理论
收敛
速率。
自适应方法
(
adagrad
、
rmsprop
、
adam
) — 维护按参数自适应的
学习率
,根据梯度历史进行调整。
二阶方法
—
牛顿法
和 L-
bfgs
等算法利用曲率信息(Hessian 矩阵或其近似)来加快
收敛
,但对大规模问题往往代价过高。