Skip to content

引言

深度学习(Deep Learning),也称为深度结构化学习或分层学习,是机器学习 (ML) 的一个子领域,而机器学习本身又是人工智能 (AI) 的一个分支。它专注于那些受人脑结构和功能启发的算法,特别是具有多层人工神经网络的算法。

深度学习的核心是采用算法,这些算法使用多层处理单元来逐步从原始输入数据中提取更高层次的特征。每一层都将前一层学习到的表示转换为一个稍微更抽象的表示。这种分层特征学习是区分深度学习与传统“浅层”机器学习方法的关键特征。

例如,在图像识别中,第一层可能学习检测边缘,下一层可能组合边缘来检测形状或纹理,随后的层可能检测物体的一部分,而最后的层会将这些部分组合起来识别完整的物体。

深度学习算法和网络的关键特征包括:

  • 多层: 通常涉及具有多个隐藏层(因此称为“深度”)的神经网络。常见的架构包括深度神经网络 (DNNs)、卷积神经网络 (CNNs)、循环神经网络 (RNNs) 和 Transformer。
  • 分层特征学习: 自动从数据中学习多抽象级别的特征和表示,减少了许多传统机器学习方法中所需的手动特征工程。
  • 从大型数据集学习: 深度学习模型通常需要大量标记数据(在监督学习中)或未标记数据(在无监督或自监督学习中)才能达到高性能。
  • 使用梯度下降: 训练通常依赖于梯度下降优化算法的变体来调整网络参数(权重和偏置)以最小化损失函数。
  • 计算密集: 训练深度模型计算量可能很大,通常需要专用硬件,如图形处理单元 (GPUs) 或张量处理单元 (TPUs) 来加速。

深度学习已在多个领域取得了显著成功,包括计算机视觉(图像分类、目标检测)、自然语言处理(机器翻译、文本生成、情感分析)、语音识别、推荐系统、生物信息学、药物发现和自主系统。在许多这些领域,深度学习模型的性能已经达到甚至超越了人类专家水平。

本教程将引导您了解深度学习的基本概念,并演示如何使用流行的 Python 库,如 TensorFlow 和 PyTorch 来实现这些强大的技术。