人类创造的机器学习(ML)算法种类繁多,然而在研究和工业领域中,真正应用广泛的并不多。对于个人而言,想要全面掌握所有这些算法的细节并不容易。一些人可能会误认为这些算法彼此之间毫无关联。尤其在面对两种看似都有效的算法时,如何做出选择成为一个难题。
本篇文章旨在为读者提供一种全新的视角来看待机器学习算法。通过这种视角,我们可以将不同算法放在同一维度上进行对比,从而更容易进行分析。本文重点讨论了两大主要任务:回归和分类。
算法效率
在评估算法性能时,通常会考虑其执行时间。在理论层面,我们可以通过算法的基本运算次数来衡量其效率,即计算复杂度。尽管实际应用中,人们更关心算法在训练过程中的耗时,但在比较不同算法时,采用最坏情况下的计算复杂度更为合理。这样做可以消除硬件配置、编程语言等因素的影响,使我们更专注于算法本身的操作特点。
值得注意的是,算法在训练阶段和预测阶段的表现可能存在较大差异。例如,线性回归这类参数化模型可能需要较长的时间进行训练,但在预测阶段却表现出较高的效率。
更多信息
点击下方链接获取更多相关内容。