前 言
一、为什么要写本书
近年来,随着人工智能特别是大模型技术的迅猛发展,深度学习的应用已从实验室走
向了各行各业。从图像识别、自然语言处理到多模态感知与智能体应用,AI 的能力边界不
断被拓展。然而,很多开发者在学习与实践过程中仍面临一个现实问题:能够跑通一个模型,
却难以将其稳定、高效、可扩展地应用到实际场景。
深度学习的成功不仅依赖模型本身,更取决于从数据采集与处理到模型设计与优化,
再到部署与应用的完整流程。市面上的多数图书大多侧重于某一环节,要么强调模型结构,
要么突出工具用法,缺乏对全链路的系统化梳理。这种割裂使读者在面对大模型微调、知
识库构建、知识库检索增强生成(Retrieval-Augmented Generation,RAG)系统设计或智
能体落地时,往往缺乏整体视角。
本书的目标正是打破这种局限,构建一条从模型开发到大模型应用的完整路径。我们
希望读者不仅能掌握训练模型的方法,而且能理解如何准备高质量数据、如何优化训练流程、
如何部署和加速模型,并最终走向多模态与大模型应用的实践层面。
二、内容特色
z 内容基础,结构清晰
内容既涵盖经典深度学习方法(CNN、RNN、Transformer 等),也介绍大模型相关实
践(LoRA 微调、知识库 RAG 系统设计、智能体设计),帮助读者同时掌握“基础功”与“新
技能”。
z 体系完整,循序渐进
以“环境搭建 → 数据准备 → 模型构建 → 模型训练 → 模型部署 → 任务应用 → 智能
体”为主线,系统梳理了大模型的完整开发流程,帮助读者形成整体认知。
z 案例丰富,注重实践
结合图像分类、目标检测、文本生成、语音识别、多模态问答等任务案例,配合工程
化的代码示例与工具说明,突出可操作性。
三、数字资源说明
z 程序代码、模型文件、数据文件等资源:扫描下方“学习资源”二维码下载。
z 教学课件、思维导图等资源:扫描下方“教学资源”二维码下载,或者到清华大
学出版社官方网站本书页面下载。
z 微课视频(120 分钟,50 集):扫描书中相应章节的二维码在线学习。
学习资源 教学资源
注:请先扫描封底刮刮卡中的文泉云盘防盗码进行绑定后再获取相应资源。
四、致谢
感谢在我工作与研究中给予支持的同事、伙伴和学生们,你们的思考与实践为本书提
供了宝贵经验。感谢开源社区推动了深度学习框架与工具的发展,使我能在前沿生态中总
结方法。感谢导师、合作机构的启发,以及家人在写作中的理解与陪伴。限于个人视野与
经验,书中难免有不足之处,恳请读者批评指正。最后,感谢每一位读者的关注,愿本书
助你更好地理解深度学习全流程,并在大模型时代获得启发与实践动力。
胡群超
2026 年 5 月
