智能体的超级大脑:大模型工作原理揭秘
智能体的超级大脑,大模型工作原理揭秘。

作者:[美] 爱德华·拉夫(Edward Raff)德鲁·法里斯(Drew Farris)斯特拉·比德曼(Stella Biderman)著 刘康 译

定价:59.8元

印次:1-1

ISBN:9787302719823

出版日期:2026.07.01

印刷日期:2026.07.07

图书责编:王军

图书分类:零售

电子书
在线购买
分享
内容简介
作者简介
前言序言
资源下载
查看详情 查看详情 查看详情

"大语言模型(LLM)让人工智能真正“智能”起来。通过连接数十亿份文档中的词语、概念和模式,LLM能够生成类似人类的回应——这也是我们在ChatGPT、Claude和DeepSeek等工具使用过程中习以为常的体验。在这本兼具知识性与趣味性的书中,博思艾伦咨询公司(Booz Allen Hamilton)全球**的机器学习研究员们,深入探讨了LLM的基础概念、发展机遇与局限性,以及将人工智能融入企业组织和应用程序的**实践方法。 这本书带你走进LLM的内部世界,一步步解析自然语言提示词如何转化为清晰、易读的文本补全结果。全书以通俗易懂的语言撰写,无须任何机器学习或人工智能基础,你就能学会LLM的构建原理、出错原因,以及如何设计可靠的人工智能解决方案。阅读过程中,你还会了解LLM的“思考”方式、如何设计基于LLM的智能体与问答系统等应用,以及如何应对人工智能领域的伦理、法律和安全问题。 主要内容 ?为特定应用定制 LLM ?降低劣质输出与算法偏见的风险 ?破除关于 LLM 的种种误区 ?**传统自然语言处理的技术边界"

爱德华???拉夫(Edward Raff)、德鲁???法里斯(Drew Farris)、斯特拉???比德曼(Stella Biderman)任职于博思艾伦咨询公司,分别担任新兴人工智能总监、人工智能/机器学习研究总监以及机器学习研究员。

行业名家推荐 随着AI在日常生活中的越发普遍,我一直在寻找一本可以向我周边的非科班的朋友推荐的大模型科普著作,以跟他们解释这背后的种种为什么。这本书恰好是那个合适的著作,它用通俗语言拆解大模型的底层逻辑,把复杂技术讲得清晰易懂,是普通人也能读懂的AI入门佳作;译者也以扎实的专业功底与细腻的文字表达,用中文赋予了原著同样的流畅度与温度。 ——朱颢,蔚来汽车「SkyOS·天枢」负责人,软件平台助理副总裁 作为数据领域从业者,近几年深刻感受到大语言模型对于行业的冲击,无论是用户业务还是数据系统,大模型都在重塑整个链条。面对各种新名词的持续涌现,浮躁与焦虑也随之而来。这本书能帮人沉下心来,建立对大模型更全面的认知,既不回避技术细节,也不让人迷失在公式里,并能就风险与局限进行坦诚讨论。译者翻译同样令人放心,专业、流畅,没有让好内容折损在语言转换上。这是一本我会推荐给团队每个成员的书。 ——王烨,字节跳动数据BP团队负责人 这本书以严谨且通俗的方式梳理了大模型的关键原理与发展脉络,对核心概念、技术逻辑和应用边界都作了清晰说明。对于希望系统理解大模型的人而言,这是一本兼具专业性、准确性与可读性的优秀读物。 ——赵龙,前知乎搜索技术负责人 真正懂AI的人往往不会无脑推崇最强模型,而是深刻理解区别和边界。这本书最大的价值,就是不带任何滤镜地向你展示大模型能做什么和不能做什么。 当理解了大模型的局限和自动化的风险后,你才能真正将“超级大脑”变成解决具体业务场景的利器。 ——行一,国内头部视频生成大模型团队,数据策略专家 大语言模型驱动的AI浪潮已席卷社会的方方面面,...

目录
荐语
查看详情 查看详情
目    录

第1章  宏观视角:什么是大语言模型  1

1.1  生成式AI的定位  2

1.2  本书能带给你什么  5

1.3  LLM工作原理初探  7

1.4  到底什么是智能  9

1.5  人类与机器表征语言的方式有何不同  10

1.6  GPT及其同类模型  12

1.7  LLM为何表现如此出色  13

1.8  LLM实战:优势、缺陷与隐患  15

本章小结  16

第2章  分词器:LLM如何“看见”世界  19

2.1  词元:文本的数值表征形式  20

2.2  语言模型只能“看见”词元  21

2.2.1  分词的基本流程  23

2.2.2  分词过程中的词汇量控制  25

2.2.3  分词原理详解  27

2.2.4  分词的潜在风险  31

2.3  分词与LLM的能力边界  33

2.3.1  LLM不擅长文字游戏  34

2.3.2  LLM在数学任务上表现不佳  35

2.3.3  LLM与语言公平性问题  36

2.4  自测小练习  37

2.5  分词的整体定位  38

本章小结  38

第3章  Transformer:从输入到输出  41

3.1  Transformer模型  42

3.2  Transformer架构深度解析  46

3.2.1  嵌入层  47

3.2.2  Transformer层  53

3.2.3  反嵌入层  56

3.3  创造性与主题相关性的权衡  60

3.4  Transformer的整体定位  61

本章小结  62... 查看详情

无论你是企业首席执行官、机器学习工程师、业余程序员,还是仅希望用好这项技术的普通用户,我们都希望你能从本书中有所收获,读懂驱动大语言模型运行的算法与技术。本书凝聚了我们在自然语言处理、机器学习及算法研究领域的实践经验,力求以深入浅出的方式分享知识,让绝大多数读者都能轻松理解。本书将为你揭开大语言模型的神秘面纱,阐明其技术局限性,并深入探讨这项迷人新技术所带来的深远影响。期待与你一同开启这段探索之旅。


查看详情