只卖百元的国产相机?是玩具吗?
[FAI] 中科大 王博涵 | 为什么Adam比SGD收敛快?
【烨·泛化】2.6.1: 神经网络中的Rademacher Complexity! IT FAILS!
[FAI] 清华 温凯越 | SAM 算法为何有用?
【烨·泛化】0.2.1: ERM模型
【烨·泛化】序言:这可能将是全网最全的泛化理论课程!
【烨】我们办了个贼酷的研讨班!
AI 理论里程碑!一致收敛为何无法解释泛化 | NeurIPS19' Outstanding New Directions 论文赏析
【烨】高维概率 | 9: 随机矩阵基础
【烨·泛化】7.1.1: 良性过拟合 Benign Overfitting
[FAI] UMich 马鉴昊 | 深度学习真的需要逃离鞍点吗?
[FAI] Mila 张鼎怀 | GFlowNets: 结构化概率推断中的探索
[FAI] 普林斯顿 黄凯旋 | 扩散模型统计理论
[FAI] 清华 顾欣然 | Local SGD竟比SGD泛化得更好——为什么?
【烨·泛化】2.2.1: VC维
【烨·泛化】2.3.3: Rademacher Complexity (property)
【烨·泛化】2.6.3: 一致收敛完蛋了吗?或许也没那么糟... 无噪情况的一致收敛
【烨·泛化】2.3.2: Rademacher Complexity (proof)
【烨·泛化】2.3.4: 线性函数族的Rademacher Complexity
【烨】(3) 伯恩斯坦不等式 | 无聊的《高维概率》课程
宇宙最最最有意思的人工智能基础seminar,真的不来玩吗!?