


定价:89元
印次:1-1
ISBN:9787302722892
出版日期:2026.08.01
印刷日期:2026.08.26
图书责编:赵佳霓
图书分类:零售
本书讲解深度学习中的相关算法,通过细致地介绍和生动形象的实例,帮助读者理解深度学习的原理,打开了解ChatGPT、DeepSeek等近期主流模型的大门。 本书共14章,采用循序渐进的结构,从基础模型开始,逐步介绍复杂模型架构,最终聚焦于大模型的技术原理和应用实践。第1章是绪论,介绍大模型的背景,第2~13章介绍各类深度学习和大模型的原理,第14章讨论当前人工智能的缺陷,以及研究人员为了解决这些缺陷所做出的努力。 本书内容翔实、覆盖面广,在讲解过程中列举了生动形象的实例,适合对深度学习感兴趣的初学者入门,并为作为领域的专业人士的参考读物。
王翔宇,在大型证券公司担任算法工程师、技术专家,有近10年金融科技相关工作经验,从事金融产品分析、算法研究、量化投资工作。在CSSCI核心期刊、CPCI会议等发表多篇论文。在CSDN技术社区发表深度学习、机器学习、大模型、Python技术相关原创博客30多篇,总阅读量超18万人次。
前言 深度学习的浪潮席卷而来,尤其是大模型的兴起,不仅在学术领域持续突破边界,更在实际应用中展现出越来越强的生命力。从早期的神经网络模型到如今参数规模惊人的大模型,技术的迭代速度之快,让每个关注它的人都深感探索的必要。 目前的学习环境远比过去便利。互联网构建起了触手可及的知识网络,从经典论文中模型设计的原始灵感,到技术博客中深入浅出的拓展思考; 从视频网站中生动直观的原理讲解,到GitHub等代码仓库中可直接复现的模型代码; 从深度学习社区中实时的互动问答,到豆包、DeepSeek等AI工具精准高效的辅导。这无疑是一个学习成本极低的时代,愿我们都能利用好这些资源,在探索中少走弯路。 笔者是一名对深度学习抱有浓厚兴趣的从业者,工作之余,喜欢了解和思考深度学习和大模型的原理,经整理后总结成博文,在机缘巧合之下,这些原本只为自用的笔记,有了被整理成书的机会。这离不开身边家人及朋友的鼓励,更要感谢出版社的信任,让我有勇气把这些学习心得分享出来。结合自己的学习经历,笔者深感数学与代码相结合是理解模型原理的有效方式。从模型设计的数学逻辑,到代码的实现细节,形成完整的闭环,往往能带来更深刻的理解。当思维困于晦涩的技术原理时,分析代码并调试运行,往往会让人豁然开朗。 本书共14章,第1章为绪论,介绍大模型的背景。第2~5章,分别介绍深度学习的基础模型,这些模型成为深度学习的基本元素。 第2章多层感知机,多层感知机是神经网络最基础的模型,具有重要意义。本章介绍了神经网络的基本组成单元——神经元和激活函数,讲解神经网络基本的计算和训练过程——前向传播和误差反向...
目录
本书源码
第1章绪论
1.1深度学习和大模型的定义
1.2人工智能的演进
1.3人工智能的三大范式
1.4深度学习的核心价值
1.5深度学习的应用领域
1.6读者指南
1.6.1前置知识
1.6.2编程环境准备
第2章多层感知机
2.1模型结构
2.2模型的计算
2.2.1确定模型架构
2.2.2符号表示
2.2.3参数初始化
2.2.4正向计算过程
2.2.5误差反向传播
2.2.6预测过程
2.3模型的意义
2.4模型的不足
2.5模型优化技巧
2.5.1初始化技术
2.5.2激活函数
2.5.3Dropout正则化
2.5.4小批量梯度下降法
2.6常见概念的联系和区别
2.7案例1: 多层感知机拟合各类函数
2.8案例2: 多层感知机预测泰坦尼克号乘客生还概率
2.8.1描述性统计
2.8.2多层感知机建模
2.8.3特征重要性分析
2.8.4利用模型预测
2.8.5数据处理拓展
第3章卷积神经网络
3.1模型结构
3.1.1设计思路
3.1.2卷积层
3.1.3池化层
3.1.4全连接层
3.1.5激活函数
3.2卷积与池化的计算
3.2.1卷积的概念
3.2.2卷积的例子
3.2.3卷积的计算
3.2.4带步长和填充的卷积计算
3.2.5池化的计算
3.3反... 查看详情
本书基于主流的编程语言Python,使用常用的TensorFlow等模块实现模型辅以示例代码和大量注释,便于读者理解和上手;从模型设计理念入手,让读者了解模型如此设计的原因、直觉,知其然也知其所以然。
查看详情





