从统计学习的视角看,现代神经网络确实可以理解为一个大规模的最大似然估计(MLE)过程。具体而言,神经网络是一个参数化函数,而最常见的训练方式正是在数据上做最大似然估计。
本文介绍了博弈论中经典的 37% 法则及其数学推导过程。