Skip to content

机器学习 - 传统人工智能

人工智能 (AI) 的旅程始于 20 世纪中叶,当时计算能力与现在截然不同。早期的 AI 尝试通常涉及机器以类似于统计学家使用计算器和统计模型的方式进行预测。因此,最初的 AI 发展深深植根于已有的统计技术。

在本章中,我们将探索这些基础统计技术及其在机器学习 (ML) 历史和当代背景下的相关性。

许多 AI 应用的基石,尤其是在早期,是由传统统计方法构成的。你可能在学习中回忆起使用诸如直线插值之类的技术来预测未来值。许多此类统计方法被成功地应用于创建当时被认为是 AI 程序的东西。我们使用“早期 AI 程序”这个术语,是因为如今的 AI 系统要复杂得多,通常采用的技术远超这些经典统计方法,特别是在处理海量数据集时。

在早期 AI 发展中发挥了关键作用,并且至今仍是理解许多 ML 概念基础的主要统计技术包括:

  • 回归 (Regression):预测连续值(例如,根据房屋特征预测房价)。
  • 分类 (Classification):将项目分配到预定义的类别(例如,垃圾邮件检测)。
  • 聚类 (Clustering):在没有预定义类别的情况下将相似项目分组在一起(例如,客户细分)。
  • 概率论 (Probability Theories):量化不确定性并进行推断(例如,贝叶斯方法)。
  • 决策树 (Decision Trees):基于选择及其可能结果的树状模型进行决策。

这些技术为理解 AI 和 ML 提供了坚实的基础。它们在处理结构化、相对较小的数据集时特别有效,在这种情况下,领域知识可以指导特征工程(feature engineering),即选择和转换输入变量的过程。例如,从原始数据中创建有意义的特征对于这些模型的良好性能至关重要。

然而,现代时代的特点是数据呈爆炸式增长——通常称为“大数据”。使用纯粹的传统统计技术分析如此海量且通常非结构化的数据集(如图像、文本或传感器读数)可能具有挑战性,因为它们存在固有的假设和计算限制。这催生了更高级方法的发展,例如深度学习 (deep learning),它可以自动从大量数据中学习复杂的模式和特征。

随着本教程的深入,我们将更深入地探讨什么是机器学习,这些基础技术如何融入其中,以及如何使用深度学习等现代方法来开发复杂的 AI 应用。