码迷,mamicode.com
首页 > 其他好文 > 详细

Batchsize与learning rate

时间:2019-09-13 17:10:55      阅读:105      评论:0      收藏:0      [点我收藏+]

标签:src   arm   准备   detection   因此   nal   detail   err   richtext   

https://www.zhihu.com/question/64134994

1、增加batch size会使得梯度更准确,但也会导致variance变小,可能会使模型陷入局部最优;

2、因此增大batch size通常要增大learning rate,比如batch size增大m倍,lr增大m倍或者sqrt(m)倍,但并不固定;

3、learning rate的增加通常不能直接增加太大,一般会通过warm up逐步增大;

4、warm up策略参考 Bag of Freebies for Training Object Detection Neural Networks

    准备用m个batches来热身,准备的初始学习率是 技术图片 ,然后在每个batch 技术图片 ,将每次的学习率设为 i*n/m

Batchsize与learning rate

标签:src   arm   准备   detection   因此   nal   detail   err   richtext   

原文地址:https://www.cnblogs.com/573177885qq/p/11517127.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!