Why do large batch sized trainings perform poorly in SGD - Generalization Gap Ex
26
0
2021-03-02 21:03:15
1
投币
1
分享
课程总结
收起全部章节
关闭课程总结
暂无课程总结
https://www.youtube.com/watch?v=crag6bMM-0k
On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima
https://arxiv.org/abs/1609.04836