1.1 NAS 的背景与动机 第一章:引言与概述 1.1 NAS 的背景与动机 深度学习,作为人工智能领域中最激动人心的分支之一,近年来取得了令人瞩目的成就。从图像识别、自然语言处理到强化学习和生成模型,深度神经网络(DNNs)已经渗透到我们生活的方方面面,并在诸多复杂任务中超越了人类水平。这场深度学习的革命,很大程度上归功于神经网络架构的创新与发展。 早期的神经网络,例如感知机和浅层神经网络,受限于其结构复杂度和计算能力的不足,在处理复杂问题时表现乏力。然而,随着反向传播算法的成熟、计算硬件的飞速发展以及诸如卷积神经网络(CNNs)、循环神经网络(RNNs)等高效架构的提出,深度学习的能力被彻底释放。
深度学习,作为人工智能领域中最激动人心的分支之一,近年来取得了令人瞩目的成就。从图像识别、自然语言处理到强化学习和生成模型,深度神经网络(DNNs)已经渗透到我们生活的方方面面,并在诸多复杂任务中超越了人类水平。这场深度学习的革命,很大程度上归功于神经网络架构的创新与发展。
早期的神经网络,例如感知机和浅层神经网络,受限于其结构复杂度和计算能力的不足,在处理复杂问题时表现乏力。然而,随着反向传播算法的成熟、计算硬件的飞速发展以及诸如卷积神经网络(CNNs)、循环神经网络(RNNs)等高效架构的提出,深度学习的能力被彻底释放。这些经典的神经网络架构,如同精巧的工程奇迹,是人类专家智慧的结晶,它们在特定的任务领域展现出卓越的性能,推动了人工智能技术的快速进步。
然而,人工设计神经网络架构并非易事。它往往依赖于深度学习专家的丰富经验、直觉以及大量的试错。架构设计的过程繁琐耗时,需要反复调整网络层数、类型、连接方式、超参数等,才能找到一个在特定任务上表现良好的架构。即使是经验丰富的专家,也难以穷尽所有可能的架构空间,并且设计的架构往往带有一定的主观性和局限性。
更重要的是,针对不同任务和数据集,最优的神经网络架构往往千差万别。一个在图像分类任务上表现优秀的 CNN 架构,可能在自然语言处理任务中表现平平。这种任务依赖性使得人工架构设计变得更加复杂和耗时。为了针对每个新的任务或数据集都找到一个高性能的架构,研究人员和工程师们需要投入大量的时间和精力进行实验和调优,这无疑限制了深度学习技术的应用范围和发展速度。
神经网络架构搜索 (Neural Architecture Search, NAS) 的出现,正是为了解决人工神经网络架构设计的局限性而诞生的。 NAS 的核心思想是利用算法自动地搜索最优的神经网络架构,从而将人类专家从繁琐的手动设计工作中解放出来,并有望发现超越人类直觉的、更高效、更强大的神经网络架构。
为了更清晰地理解 NAS 的背景与动机,我们可以将其置于更宏大的历史和技术背景下进行审视。
深度学习的崛起并非一蹴而就,它经历了漫长的发展和积累。早期的神经网络研究虽然充满希望,但受限于计算能力和算法的不足,长期处于低谷。直到 2006 年,Hinton 等人提出的深度信念网络(DBN)和深度学习的概念,以及随后 AlexNet 在 2012 年 ImageNet 图像识别竞赛中取得的突破性进展,才真正开启了深度学习的新时代。
AlexNet 的成功,不仅证明了深度神经网络的强大能力,也标志着深度和复杂的神经网络架构开始成为主流。此后,VGG、GoogleNet、ResNet、DenseNet 等一系列更深、更复杂的神经网络架构相继涌现,不断刷新着各种任务的性能记录。这些架构的成功,进一步推动了深度学习在各个领域的应用,也使得神经网络架构设计的重要性日益凸显。
然而,随着神经网络架构变得越来越复杂,人工设计的难度也呈指数级增长。设计一个高性能的神经网络架构,不再仅仅是简单的堆叠网络层,而是需要考虑各种因素,包括:
面对如此庞大且复杂的架构设计空间,人工设计变得越来越力不从心。深度学习专家们往往需要花费大量的时间和精力,进行反复的实验和调优,才能找到一个在特定任务上表现良好的架构。这种高度依赖专家经验和试错的方法,不仅效率低下,而且难以保证找到全局最优的架构。
更令人担忧的是,人工设计的神经网络架构往往带有一定的主观性和局限性。人类的直觉和经验虽然在某些情况下可以发挥作用,但也很容易受到固有思维模式的束缚,忽略一些潜在的、更优的架构。例如,ResNet 的残差连接结构,在最初提出时就有些反直觉,但却被证明是解决深度网络训练困难的有效方法。这表明,神经网络架构设计领域仍然存在着许多未被探索的未知空间,而人工设计很难触及到这些领域。
为了更深入地理解人工设计神经网络的局限性,我们可以从以下几个方面进行分析:
可以用一个图来形象地展示人工设计神经网络的局限性:
上图清晰地展示了人工设计神经网络的几个主要局限性,这些局限性严重阻碍了深度学习技术的进一步发展和应用。
为了克服人工设计神经网络的局限性,研究人员开始探索自动化神经网络架构设计的方法。神经网络架构搜索 (NAS) 应运而生,它的目标是利用算法自动地搜索最优的神经网络架构,从而将人类专家从繁琐的手动设计工作中解放出来,并有望发现超越人类直觉的、更高效、更强大的神经网络架构。
NAS 的核心思想可以概括为以下几点:
NAS 的基本流程可以用一个图来表示:
上图展示了 NAS 的基本流程,从定义搜索空间和搜索策略开始,通过搜索策略在搜索空间中探索不同的架构,然后对搜索到的架构进行性能评估,根据评估结果决定是否继续搜索,直到满足停止条件,最终输出最优的架构。
NAS 的诞生,标志着神经网络架构设计从人工驱动向算法驱动的转变。它不仅可以显著提高架构设计的效率,降低对专家经验的依赖,而且有望发现超越人类直觉的、更优的神经网络架构,推动深度学习技术的进一步发展。
NAS 的核心动机可以归纳为以下几个方面: