新书推荐

理解深度学习

作者[美] 西蒙·J.D. 普林斯

译者张亚东,马壮

出版社清华大学出版社

出版时间2025年7月

页数444

定价188.00元


《理解深度学习》(Understanding Deep Learning)是计算机科学家西蒙·J·D·普林斯撰写的一部深度学习教科书,英文原版2023年12月由麻省理工学院出版社(MIT Press)出版。英文版从发布起就在网站上免费开放,采用允许非商业传播的知识共享许可,累计下载量已超过69万次,这个数字在同类学术教科书里相当罕见。

本书开篇两章是引言和监督学习:第1章把机器学习划分为监督、无监督、强化三类学习,并预告了全书最后会讨论的伦理问题;第2章用一个最简单的一元线性回归例子,把"模型—损失—训练"这条主线立起来。第3、4章进入神经网络本身,先讲只有一个隐藏层的浅层网络,用通用逼近定理说明为什么神经元足够多时网络能近似任何连续函数,再讲多层堆叠的深层网络,引入矩阵表示简化记号,并比较浅层与深层网络在参数效率和表达能力上的差别。第5到9章解决"怎么把网络训练好"的问题:第5章从最大似然估计出发,给出一套构建损失函数的统一方法,回归、二分类、多分类等各类预测问题都能套用同一套"配方";第6章讲梯度下降、随机梯度下降、动量法和Adam优化器;第7章讲反向传播算法和参数初始化的原理;第8章讲如何衡量模型性能、误差从哪里来,还讨论了"双下降"这类近年才被系统认识的现象;第9章讲正则化,包括显式正则化与隐式正则化。

第10到13章是各类主流架构。卷积网络一章从不变性与等变性这两个性质入手,解释卷积为什么适合处理图像;残差网络一章讲残差连接、批归一化和常见的残差结构;Transformer一章分量很重,从点积自注意力讲起,分别用BERT、GPT-3和机器翻译系统作为编码器、解码器与编码器—解码器三类模型的例子,还讨论了长序列处理和把Transformer用到图像上的做法;图神经网络一章讲图数据的表示、图卷积网络以及节点分类、图分类等任务。第14到18章是无监督学习和生成模型,这是本书相对许多旧教材的特色所在:先给出无监督学习的分类框架和生成模型的评价标准,然后逐一介绍生成对抗网络(GAN)、标准化流、变分自编码器(VAE)和扩散模型,其中扩散模型一章详细讲了前向加噪、反向去噪和训练过程,是教材里较早系统覆盖这一主题的。第19章是强化学习,覆盖马尔可夫决策过程、表格方法、Q学习、策略梯度、Actor-Critic和离线强化学习。最后两章收尾:第20章正面回应"为什么深度学习有效"这个理论上尚未完全解决的问题,讨论泛化、参数冗余和深度是否必要;第21章讨论伦理,包括价值对齐、恶意滥用和负责任的研究,并给出案例分析。

本书有几个鲜明的特点。第一是内容新、覆盖全。Transformer、扩散模型这些在多数旧教材里缺失的专题,在这里都有独立成章的系统介绍,出版时间与前沿基本同步。第二是"化繁为简"的写法:每一章都遵循"先用日常语言讲清概念,再用数学形式精确表达,最后用精心设计的插图建立直觉"的三层递进,作者刻意删减了大量枝节,只保留最关键的思想,所以章节短小、信息密度高,读起来不像许多教科书那样被技术细节淹没。插图是这本书口碑最好的部分之一,大量配图是作者专门为讲清某个概念设计的,读者普遍反映比一般教材的配图更有说明力。第三是自足性和实践性:数学、概率两个附录让数学基础一般的读者也能跟上;全书配有68个Python Notebook编程练习、每章习题和教师课件,鼓励读者动手实现模型的初级版本,作者网站还在持续更新勘误和补充材料。第四是每章末尾的"注释"部分,它给出本章内容的研究文献和来龙去脉,相当于每章附了一份精读指引,对想深入研究的读者价值很大。

本书出版后获得了相当高的评价。《自然》旗下期刊Nature Machine Intelligence撰文推荐,称它"当之无愧的经典之作,是目前最优秀的深度学习教科书",并称之为"即时经典";《概率机器学习》的作者、Google DeepMind研究科学家凯文·墨菲(Kevin Murphy)评价它是"学术与视觉双重精妙的杰作……当今最出色的深度学习入门著作"。在Amazon和Goodreads上,这本书的评分普遍很高,读者反馈集中在"讲解清晰、插图优秀、从直觉到数学的过渡自然"上,也有不少人说它的最大价值在于让读者快速建立对整个领域的整体认识。它很快被许多高校选作本科或研究生课程教材,包括一些人工智能方向的硕士课程;免费的英文版加上超过69万的下载量,使它成为近年流传最广的深度学习读物之一。

本书作者西蒙·普林斯的履历横跨心理学和计算机科学。他在伦敦大学学院(UCL)读本科,专业是心理学,随后在UCL取得计算机视觉方向的硕士学位,再到牛津大学实验心理学系攻读博士,课题是用心理物理学方法研究人类立体视觉。博士毕业后,他在牛津大学生理学实验室做过两年博士后,用单神经元电生理方法继续研究立体视觉,此后先后到新加坡国立大学和加拿大约克大学做博士后,转向计算机视觉与增强现实。2005年他回到伦敦大学学院计算机科学系任教,讲授机器视觉、图像处理和高等数学方法等课程,并于2012年出版了《计算机视觉:模型、学习和推理》(Computer Vision: Models, Learning and Inference),这部由剑桥大学出版社出版的教材至今仍是计算机视觉领域广为使用的参考书。2012年起他进入工业界研究机构,先后在Anthropics Technologies、加拿大Borealis AI等机构担任研究科学家并领导研究团队,2022年任英国巴斯大学计算机科学全职教授,如今是该校名誉教授。

点击查看馆藏资源


下一条:最后的江湖戏班

关闭

地址:江苏省南京市浦口区宁六路219号  邮编:210044

电话:86-25-58699775

版权所有 ©2020-  南京信息工程大学图书馆