目录
第1章人工智能与计算思维概述1
1.1人工智能概览1
1.1.1人工智能与人类智能的定义1
1.1.2人工智能的起源与发展历程3
1.1.3人工智能的要素6
1.1.4人工智能的分类6
1.1.5人工智能的主要学派7
1.2人工智能的关键技术8
1.2.1现代知识建模与表示8
1.2.2智能搜索与逻辑推理15
1.2.3机器学习23
1.3人工智能的应用领域29
1.3.1自然语言处理29
1.3.2计算机视觉31
1.3.3智能推荐系统33
1.3.4语音识别与合成34
1.3.5生成式人工智能35
1.3.6自动驾驶36
1.4计算思维与人工智能的关系37
1.4.1计算思维的定义与本质37
1.4.2计算思维的四大核心支柱38
1.4.3生活中的计算思维38
1.4.4计算思维与人工智能39
第2章计算机系统41
2.1计算机系统概述41
2.1.1计算机系统的层次结构41
2.1.2经典冯·诺依曼架构42
2.1.3计算机技术的发展脉络与计算机系统的分类42
2.1.4计算模式演进与人工智能新时代44
2.2计算机硬件系统45
2.2.1运算器: 数据处理的核心部件45
2.2.2控制器: 系统的“指挥官”45
2.2.3中央处理器: 运算器与控制器的统一体46
2.2.4人工智能加速硬件: GPU、TPU与NPU48
2.2.5存储器: 数据与程序的“仓库”51
2.2.6系统支撑硬件: 算力底座的物理保障53
2.2.7输入设备与输出设备54
2.2.8硬件系统的协同工作原理57
2.3计算机软件系统58
2.3.1系统软件: 计算机的“底层支撑”58
2.3.2应用软件: 满足具体需求的工具59
2.3.3软件与硬件的关系61
2.4计算机网络基础62
2.4.1计算机网络的定义与核心功能62
2.4.2常用网络类型与拓扑结构63
2.4.3网络与人工智能的关联66
2.4.4云计算、边缘计算与人工智能的融合66
第3章机器学习68
3.1机器学习概述68
3.1.1机器学习的定义与核心思想68
3.1.2机器学习的基本概念70
3.1.3机器学习的分类72
3.1.4机器学习的基本流程75
3.1.5机器学习的应用场景76
3.2有监督学习77
3.2.1有监督学习概述78
3.2.2分类问题80
3.2.3回归问题91
3.3无监督学习94
3.3.1无监督学习概述94
3.3.2聚类问题96
3.3.3降维问题102
3.4强化学习104
3.4.1强化学习的基本原理104
3.4.2强化学习的基本过程105
3.4.3强化学习的常见算法105
3.5人工神经网络和深度学习106
3.5.1人工神经网络106
3.5.2深度学习108
第4章计算机视觉111
4.1计算机视觉概述111
4.1.1什么是计算机视觉111
4.1.2计算机视觉模拟人类视觉的认知过程112
4.1.3计算机视觉的发展历程114
4.1.4人类视觉与计算机视觉的对比115
4.2计算机视觉的典型应用场景116
4.2.1安防领域——智能监控的“火眼金睛”116
4.2.2自动驾驶——车辆的“视觉神经”118
4.2.3医学影像——辅助诊断的“第二双眼睛”120
4.2.4工业质检——生产线上的“质量卫士”121
4.2.5消费电子——提升体验的“视觉魔法”123
4.3计算机视觉的核心任务124
4.3.1图像分类与识别125
4.3.2目标检测126
4.3.3图像分割127
4.3.4目标跟踪130
4.3.5姿态估计132
4.3.6三维视觉134
4.3.7图像生成与编辑135
4.3.8视觉语义理解137
4.4计算机视觉面临的挑战138
4.4.1复杂环境干扰——计算机视觉的“拦路虎”138
4.4.2对抗攻击——微小改动引发“视觉幻觉”139
4.4.3三维场景理解——从“平面”到“立体”的难题139
第5章自然语言处理141
5.1自然语言处理概述141
5.1.1自然语言处理的核心思想141
5.1.2自然语言处理的发展历程142
5.1.3自然语言处理的主要内容142
5.1.4自然语言处理的核心挑战144
5.2自然语言处理的主要任务145
5.2.1文本预处理145
5.2.2语言结构分析146
5.2.3文本表示方法148
5.2.4语义理解与分析150
5.3自然语言处理的应用场景152
5.3.1机器翻译152
5.3.2情感分析155
5.3.3信息检索与问答系统158
5.3.4文本摘要161
5.3.5语言模型163
5.4自然语言处理工具165
第6章大模型168
6.1大模型概述168
6.1.1大模型的定义与核心特征168
6.1.2大模型的发展历程170
6.1.3大模型的核心优势与局限性172
6.1.4主流大模型简介173
6.2大模型的核心原理175
6.2.1Transformer架构基础175
6.2.2注意力机制176
6.2.3大模型的训练流程177
6.2.4大模型的扩展法则178
6.3大模型的关键技术179
6.3.1预训练技术179
6.3.2指令微调与提示学习179
6.3.3大模型的解码与部署181
6.3.4混合专家模型的基本概念182
6.4大模型的应用场景与实践183
6.4.1大模型的应用场景183
6.4.2大模型的基础使用方法184
6.4.3大模型的评测方法186
第7章智能体与具身智能188
7.1智能体概述188
7.1.1智能体的定义与核心特征188
7.1.2智能体的基本结构: 感知、决策、执行189
7.1.3智能体的分类191
7.1.4智能体的应用场景193
7.2具身智能基础194
7.2.1具身智能的定义与核心内涵194
7.2.2具身智能与传统人工智能的区别195
7.2.3具身智能的发展现状与面临的挑战196
7.3智能体与具身智能的关键技术198
7.3.1环境感知技术: 传感器、环境建模基础198
7.3.2自主决策与规划技术202
7.3.3运动控制与人机交互206
7.3.4大模型与智能体: 具身智能的融合209
7.4典型应用案例211
7.4.1智能机器人211
7.4.2自动驾驶系统213
7.4.3虚拟智能体216
第8章AIGC应用220
8.1AIGC概述220
8.1.1AIGC的定义与核心内涵220
8.1.2AIGC的发展历程与核心特征221
8.1.3AIGC与传统内容创作的区别224
8.1.4AIGC的核心价值与应用意义226
8.2AIGC的核心类型与技术基础227
8.2.1文本生成228
8.2.2图像生成230
8.2.3音频生成231
8.2.4视频生成233
8.2.5AIGC的核心技术支撑234
8.3AIGC的典型应用场景237
8.3.1办公领域237
8.3.2创作领域240
8.3.3教育领域241
8.3.4产业领域243
8.4AIGC的实践入门245
8.4.1常用AIGC工具简介245
8.4.2提示词设计技巧248
8.4.3AIGC实践案例251
附录254
参考文献273
