-
Notifications
You must be signed in to change notification settings - Fork 1
Expand file tree
/
Copy pathhistory.html
More file actions
439 lines (390 loc) · 26.7 KB
/
Copy pathhistory.html
File metadata and controls
439 lines (390 loc) · 26.7 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
235
236
237
238
239
240
241
242
243
244
245
246
247
248
249
250
251
252
253
254
255
256
257
258
259
260
261
262
263
264
265
266
267
268
269
270
271
272
273
274
275
276
277
278
279
280
281
282
283
284
285
286
287
288
289
290
291
292
293
294
295
296
297
298
299
300
301
302
303
304
305
306
307
308
309
310
311
312
313
314
315
316
317
318
319
320
321
322
323
324
325
326
327
328
329
330
331
332
333
334
335
336
337
338
339
340
341
342
343
344
345
346
347
348
349
350
351
352
353
354
355
356
357
358
359
360
361
362
363
364
365
366
367
368
369
370
371
372
373
374
375
376
377
378
379
380
381
382
383
384
385
386
387
388
389
390
391
392
393
394
395
396
397
398
399
400
401
402
403
404
405
406
407
408
409
410
411
412
413
414
415
416
417
418
419
420
421
422
423
424
425
426
427
428
429
430
431
432
433
434
435
436
437
438
439
<!DOCTYPE html>
<html lang="zh-CN">
<head>
<meta charset="UTF-8">
<meta name="viewport" content="width=device-width,initial-scale=1,viewport-fit=cover">
<title>AI发展历史 · AI大模型全景</title>
<script>(function(){var k='ai-training-theme',p='t',t=null;try{var q=new URLSearchParams(location.search);t=q.get(p)||q.get('theme');if(t!=='light'&&t!=='dark')t=sessionStorage.getItem(k);if(t!=='light'&&t!=='dark')t=localStorage.getItem(k);if(t!=='light'&&t!=='dark'){var m=document.cookie.match(new RegExp('(?:^|; )'+k+'=([^;]*)'));t=m?decodeURIComponent(m[1]):'';}if(t==='light'||t==='dark'){document.documentElement.setAttribute('data-theme',t);document.documentElement.style.colorScheme=t;try{sessionStorage.setItem(k,t);localStorage.setItem(k,t);}catch(e){}}}catch(e){}})();</script>
<link rel="stylesheet" href="style.css">
<script src="theme.js"></script>
<script src="nav.js"></script>
<script src="search-data.js"></script>
<script src="search.js"></script>
<script src="history-timeline.js"></script>
<script src="toc.js"></script>
<script src="site.js"></script>
<script src="copy-blocks.js"></script>
<script src="data-sourcing.js"></script>
<script src="backtotop.js"></script>
</head>
<body>
<div class="hero">
<h1>📖 AI大模型发展历史</h1>
<p>从1950年图灵测试到2026年Agent元年——人工智能76年进化全景</p>
<div class="badges">
<span class="badge">76年时间跨度</span>
<span class="badge">30+ 关键节点</span>
<span class="badge">技术演进脉络</span>
</div>
</div>
<div class="page-wrap">
<div class="page-lead"><strong>本章定位:</strong>建立 AI 76 年宏观脉络。下方「完整时间线」已按年代折叠,点击标题展开;默认打开最近一段。</div>
<!-- 三次浪潮概述 -->
<div class="dbox">
<h3>🌊 AI发展的三次浪潮</h3>
<div class="grid-3" style="margin-top:16px">
<div class="ci">
<div class="ci-name">第一次浪潮 1956—1986</div>
<div style="font-size:12px;color:var(--muted);margin-top:6px">规则与逻辑时代。研究者相信可以用符号逻辑、规则系统表达人类知识。代表:专家系统。两次AI寒冬均因算力与数据瓶颈而来。</div>
<div class="tags" style="margin-top:8px"><span class="tag">符号AI</span><span class="tag">专家系统</span><span class="tag">逻辑推理</span></div>
</div>
<div class="ci">
<div class="ci-name">第二次浪潮 1986—2012</div>
<div style="font-size:12px;color:var(--muted);margin-top:6px">统计与机器学习时代。数据驱动取代规则驱动,SVM、随机森林等算法兴起,但深度神经网络受限于算力仍难规模化。</div>
<div class="tags" style="margin-top:8px"><span class="tag">机器学习</span><span class="tag">神经网络</span><span class="tag">SVM</span></div>
</div>
<div class="ci">
<div class="ci-name">第三次浪潮 2012—至今</div>
<div style="font-size:12px;color:var(--muted);margin-top:6px">深度学习与大模型时代。GPU+大数据+Transformer三重加持,AI能力出现质变。GPT→ChatGPT→Agent,每一步都在重塑世界。</div>
<div class="tags" style="margin-top:8px"><span class="tag">深度学习</span><span class="tag">大模型</span><span class="tag">Transformer</span></div>
</div>
</div>
</div>
<hr class="divider">
<div class="sec-title">⏱️ 完整时间线</div>
<div class="sec-sub">从图灵测试到 AGI 曙光——按年代折叠浏览,默认展开「2026—当下」</div>
<div class="tl" data-group-timeline>
<div class="tl-item">
<div class="tl-dot" style="background:#6ee7b7"></div>
<div class="tl-yr">1950 — 奠基</div>
<div class="tl-card">
<h4>Alan Turing《计算机器与智能》——"机器能否思考?"</h4>
<p>提出"图灵测试":如果机器在对话中无法被人类区分,则认为它具有智能。奠定AI的哲学与技术基础,这个问题至今仍是AI研究的核心命题。<br><a href="https://plato.stanford.edu/entries/turing-test/" target="_blank" style="font-size:12px">📄 Stanford哲学院 · 图灵测试详解 →</a></p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">1956 — 诞生</div>
<div class="tl-card">
<h4>达特茅斯会议——AI学科正式诞生</h4>
<p>John McCarthy、Marvin Minsky等人在达特茅斯学院召开研讨会,正式提出"人工智能"(Artificial Intelligence)这一术语。这一年被视为AI元年。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">1957 — 感知机</div>
<div class="tl-card">
<h4>Rosenblatt感知机——最早的神经网络</h4>
<p>Frank Rosenblatt发明感知机(Perceptron),这是最早可以通过数据"学习"的神经网络模型。尽管功能有限,却开创了神经网络研究先河。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:#fca5a5"></div>
<div class="tl-yr">1974-1980 — 第一次寒冬</div>
<div class="tl-card">
<h4>第一次AI寒冬——期望破灭</h4>
<p>过于乐观的预测未能兑现,NLP和计算机视觉进展缓慢,美国国防部削减AI研究经费。AI研究陷入低谷,持续约6年。教训:计算能力和数据规模是硬约束。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">1980 — 专家系统</div>
<div class="tl-card">
<h4>专家系统商业化——AI第一次大规模落地</h4>
<p>基于规则的专家系统(Expert Systems)在医疗诊断、化学分析等领域商业化,代表MYCIN系统诊断血液感染准确率超过专科医生。全球专家系统市场达数十亿美元。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:#fca5a5"></div>
<div class="tl-yr">1987-1993 — 第二次寒冬</div>
<div class="tl-card">
<h4>第二次AI寒冬——规则系统的局限暴露</h4>
<p>专家系统维护成本高昂且无法泛化,AI专用硬件(Lisp机)被通用PC取代,日本第五代计算机项目失败。资金再次大幅削减。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">1986 — 反向传播</div>
<div class="tl-card">
<h4>BP算法普及——深度学习的理论基础</h4>
<p>Rumelhart、Hinton等人推广反向传播(Backpropagation)算法,使多层神经网络的训练成为可能。这是深度学习的理论基础,但受限于算力,实用化仍需等待20年。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">1997 — 深蓝</div>
<div class="tl-card">
<h4>IBM Deep Blue击败国际象棋世界冠军卡斯帕罗夫</h4>
<p>IBM深蓝以3.5:2.5击败当时的世界棋王,引发全球轰动。虽然深蓝本质是暴力搜索而非"智能",但标志着AI在特定领域超越人类顶尖水平成为可能。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2006 — 深度学习复兴</div>
<div class="tl-card">
<h4>Hinton发表深度信念网络——深度学习复兴</h4>
<p>Geoffrey Hinton在Science发表深度信念网络(DBN)论文,证明深层神经网络可以高效训练。这一年被称为"深度学习元年",正式引发了第三次AI浪潮。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2012 — 里程碑</div>
<div class="tl-card">
<h4>AlexNet震撼ImageNet——深度学习时代开启</h4>
<p>Hinton团队的AlexNet将ImageNet图像识别Top-5错误率从25%降至16%,领先第二名超10个百分点。GPU并行计算+深度卷积网络的组合宣告深度学习时代正式到来。全球AI竞赛重燃。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2014 — GAN</div>
<div class="tl-card">
<h4>Ian Goodfellow发明GAN——生成AI的基础</h4>
<p>生成对抗网络(GAN)提出"生成器vs判别器"的对抗训练框架,开创了AI生成图像/视频的技术路线,是Midjourney、Stable Diffusion等图像生成工具的技术祖先。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2016 — AlphaGo</div>
<div class="tl-card">
<h4>AlphaGo击败李世石——强化学习震惊世界</h4>
<p>Google DeepMind AlphaGo以4:1击败围棋世界冠军李世石。围棋棋盘状态数超过宇宙原子总数,此前认为AI无法攻克。强化学习+深度学习的组合开创了新范式。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:#fcd34d"></div>
<div class="tl-yr">2017 — 🔑 最重要</div>
<div class="tl-card">
<h4>Transformer论文《Attention Is All You Need》——改变AI历史的一篇论文</h4>
<p><a href="https://arxiv.org/abs/1706.03762" target="_blank">📄 论文原文 arxiv.org/abs/1706.03762 →</a></p>
<p>Google Brain的Vaswani等8人发表论文,提出Transformer架构和自注意力(Self-Attention)机制,彻底取代了RNN/LSTM序列处理瓶颈。这是近十年最重要的AI技术突破——目前所有知名大模型(GPT/Claude/Gemini/LLaMA等)全部基于Transformer架构。</p>
<div class="note" style="margin-top:10px">🔑 <strong>为什么重要:</strong>Transformer实现了并行计算,使模型可以同时"看到"整个序列的所有位置,极大提升了语言理解能力,并可以通过增加参数规模(scaling)持续提升性能——这是大模型"规模定律"的基础。</div>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2015 — ResNet & AlphaFold</div>
<div class="tl-card">
<h4>ResNet残差网络发表 + AlphaFold破解蛋白质折叠</h4>
<p>何恺明团队提出ResNet残差网络,通过152层深度将ImageNet错误率降至3.57%,超过人类水平(5%)。ResNet论文发表于2015年12月,后获2016 CVPR最佳论文奖,成为深度学习的奠基之作。DeepMind AlphaFold首次证明AI可解决重大科学问题。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2018 — 预训练范式</div>
<div class="tl-card">
<h4>BERT + GPT-1——"预训练+微调"范式确立</h4>
<p>Google发布BERT(双向编码器),OpenAI发布GPT-1(生成式预训练)。两种模型分别代表"理解"和"生成"两条路线,共同确立了"大规模无标注数据预训练→下游任务微调"的现代NLP范式。NLP进入工业化阶段。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2019 — GPT-2</div>
<div class="tl-card">
<h4>GPT-2发布——15亿参数,OpenAI"因太危险而不敢全量发布"</h4>
<p>GPT-2生成的文章质量让OpenAI担忧被滥用,选择分阶段发布。这次事件让公众首次认识到大语言模型的潜力与风险,也引发了AI安全与伦理的广泛讨论。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2020 — 涌现</div>
<div class="tl-card">
<h4>GPT-3——1750亿参数,"涌现能力"首次出现</h4>
<p>OpenAI发布GPT-3(1750亿参数,是GPT-2的116倍),首次展现出"涌现能力"(Emergent Abilities)——无需微调,仅靠几个示例就能完成翻译、写代码、数学推理等从未专门训练的任务。"Prompt工程"概念诞生。研究者意识到:规模(Scale)本身会带来质的飞跃。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2021 — Codex & CLIP</div>
<div class="tl-card">
<h4>Codex + CLIP——代码生成与多模态双突破</h4>
<p>OpenAI Codex(GPT-3的代码版)成为GitHub Copilot的基础,AI辅助编程从概念变为产品。CLIP实现图文跨模态理解,为后来的DALL-E等图像生成铺路,多模态AI时代曙光初现。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2022 — 对话革命</div>
<div class="tl-card">
<h4>ChatGPT上线——5天百万用户,改变世界的时刻</h4>
<p>2022年11月30日,<a href="https://openai.com/chatgpt" target="_blank">OpenAI</a>基于GPT-3.5+RLHF(人类反馈强化学习)推出ChatGPT。5天用户破百万,2个月突破1亿,成为史上用户增长最快的消费级应用。RLHF让AI学会对齐人类价值观——能够拒绝有害请求、给出礼貌恰当的回答。AI从"科研工具"走向"大众消费品",全球AI创业热潮正式点燃。</p>
<div class="note" style="margin-top:8px">📊 <strong>RLHF核心思路:</strong>让人类标注员对AI输出进行打分 → 训练奖励模型(Reward Model) → 用强化学习优化语言模型,使其输出更符合人类偏好。这让模型从"能做"变成"愿意做对的事"。</div>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2023上半年 — 爆发</div>
<div class="tl-card">
<h4>GPT-4 / Claude 2 / Bard——多模态大战打响</h4>
<p>GPT-4支持图片输入,通过律师资格、医师执照等职业考试;Anthropic发布Claude 2,长文档处理能力更强;Google Bard入局;Meta开源LLaMA/LLaMA2,推动开源生态爆发。全球AI竞赛格局形成。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2023下半年 — 国产崛起</div>
<div class="tl-card">
<h4>百度/阿里/腾讯/华为/科大讯飞——国产大模型集中爆发</h4>
<p>国内掀起大模型热潮:百度文心一言、阿里通义千问、腾讯混元、华为盘古、科大讯飞星火密集发布;字节豆包、月之暗面Kimi、零一万物Yi等新势力入场;国产模型从"追赶"进入"并跑"阶段。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2024上半年 — 推理突破</div>
<div class="tl-card">
<h4>Claude 3 系列 / Gemini 1.5 Pro / DeepSeek-V2——三大技术突破</h4>
<p>Claude 3 Haiku/Sonnet/Opus建立速度-性能梯度模型体系;Gemini 1.5 Pro突破100万Token超长上下文;DeepSeek-V2以MoE架构将推理成本压缩至竞品的1/6,震惊业界。多模型共存时代正式到来。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:#fcd34d"></div>
<div class="tl-yr">2024下半年 — 视频+推理</div>
<div class="tl-card">
<h4>GPT-4o / o1 / Sora / Llama 3——推理型AI+视频生成双线突破</h4>
<p>GPT-4o实现端到端多模态(文/图/音/视),实时语音对话延迟<300ms;o1引入"思维链推理",在竞赛数学上超越99.5%人类;Sora发布引发视频生成革命;Meta开源Llama 3系列,开源生态进入高峰。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2025 — Agent元年</div>
<div class="tl-card">
<h4>DeepSeek-R1开源震撼 / Claude 3.7 / GPT-4o升级 / Qwen3——Agent全面落地</h4>
<p><a href="https://deepseek.com" target="_blank">DeepSeek-R1</a>以开源+超低成本(GPT-4o的1/30)达到同级性能,引发全球AI成本革命,美股科技股单日蒸发数千亿美元;<a href="https://anthropic.com" target="_blank">Claude 3.7</a>在多项编程评测中表现领先;AI Agent从实验室走向商业产品;具身智能(机器人)产业化加速;多模态技术全面成熟。</p>
<div class="note" style="margin-top:8px">🌍 <strong>DeepSeek效应:</strong>证明开源+高效架构可以以极小成本达到顶尖性能,推动全球AI成本大幅下降,加速AI普及。这是继ChatGPT后AI行业最重要的事件之一。</div>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--accent3)"></div>
<div class="tl-yr">2026 — 当下格局</div>
<div class="tl-card">
<h4>闭源引领 · 开源爆发 · Agent普及 · AGI曙光初现</h4>
<p>GPT-4o/Claude 3.7/Gemini 2.0三足鼎立;DeepSeek/Llama 4/Qwen3引领开源;AI Agent从产品功能变为独立服务类别;本地端侧AI(手机/PC)规模落地;具身智能进入量产阶段;OpenAI o3在ARC-AGI-1达到87%(接近人类88%),AGI争议成为科技界核心话题。</p>
</div>
</div>
</div>
<hr class="divider">
<!-- 中国AI发展史 -->
<div class="sec-title">🇨🇳 中国AI发展大事记</div>
<div class="sec-sub">从学术追赶到全球竞争——中国AI崛起之路</div>
<div class="tl" data-group-timeline>
<div class="tl-item">
<div class="tl-dot" style="background:#fcd34d"></div>
<div class="tl-yr">2015 — 视觉突破</div>
<div class="tl-card">
<h4>ResNet获CVPR最佳论文——中国学者开创性贡献</h4>
<p>微软亚洲研究院何恺明团队提出ResNet残差网络,解决深度网络退化问题,152层网络将ImageNet错误率降至3.57%(首超人类)。获CVPR 2016最佳论文奖。何恺明成为全球AI领域最具影响力的中国学者之一。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2019 — 政策驱动</div>
<div class="tl-card">
<h4>国家战略:新一代AI发展规划全面落地</h4>
<p>2017年国务院发布《新一代人工智能发展规划》,提出2025年AI产业规模超4000亿元。各大高校/企业设立AI研究院,中国AI论文数量在2019年超越美国成为全球第一。百度率先发布文心ERNIE 1.0。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--green)"></div>
<div class="tl-yr">2022 — 国产大模型起跑</div>
<div class="tl-card">
<h4>ChatGPT引发中国AI紧迫感——国产模型密集发布</h4>
<p>2022末ChatGPT爆发后,中国AI界产生巨大的"紧迫感"。2023年起百度文心、阿里通义、腾讯混元、华为盘古、讯飞星火等密集发布。字节豆包、月之暗面Kimi、零一万物Yi等创业公司跟进。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot"></div>
<div class="tl-yr">2024 — 差异化竞争</div>
<div class="tl-card">
<h4>DeepSeek-V2/Kimi长上下文/Qwen开源三线突围</h4>
<p>DeepSeek-V2以MoE架构极致降低推理成本;月之暗面Kimi以200万字超长上下文出圈;阿里Qwen系列全面开源,从0.5B到72B全覆盖,成为全球最活跃开源中文模型体系。</p>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:#fcd34d"></div>
<div class="tl-yr">2025 — 🔥 DeepSeek引发全球关注</div>
<div class="tl-card">
<h4>DeepSeek-R1开源——中国AI从"追赶"到"引领"</h4>
<p>DeepSeek-R1以GPT-4o 1/30成本达到同级性能,开源后引发美股科技股单日蒸发数千亿美元("DeepSeek Shock")。美国开始反思AI芯片出口管制效果。中国AI从"跟随者"变为"规则改变者"。</p>
<div class="note" style="margin-top:8px">🌍 DeepSeek证明:高效架构+创新工程可以弥补算力差距。中国AI公司开始走"精算力"路线,而非简单的"堆算力"。</div>
</div>
</div>
<div class="tl-item">
<div class="tl-dot" style="background:var(--accent3)"></div>
<div class="tl-yr">2026 — 全面开花</div>
<div class="tl-card">
<h4>Qwen3.6/GLM-5/Kimi K2.6/DeepSeek-V4——国产模型进入第一梯队</h4>
<p>2026年国产模型全面进入全球第一梯队:Qwen3.6-397B在SWE-bench达76.4%超越部分GPT版本;GLM-5编程能力大幅提升;Kimi K2.6 AA综合指数54分紧追国际旗舰;DeepSeek-V4 Pro SWE-bench达80.6%。AI Agent/具身智能成为中美国际AI竞争的新焦点。</p>
</div>
</div>
</div>
<hr class="divider">
<!-- 关键技术概念 -->
<div class="sec-title">🔬 必知核心技术概念</div>
<div class="sec-sub">搞懂这些概念,你就能看懂90%的AI新闻</div>
<div class="grid-2">
<div class="dbox">
<h3>Transformer & 注意力机制</h3>
<p><strong>一句话理解:</strong>让模型同时"看到"整段文字的所有位置,不再逐词顺序处理。</p>
<p>传统RNN处理"我昨天去了北京"时,需要顺序读完才能理解"北京"与"我"的关系;Transformer的自注意力可以直接建立任意词之间的关联,并且可以并行计算,大幅加速训练。</p>
<div class="tip">💡 类比:RNN像看书只能从左到右;Transformer像用荧光笔把整本书摊开,一眼扫描所有重要位置。</div>
</div>
<div class="dbox">
<h3>规模定律 (Scaling Law)</h3>
<p><strong>一句话理解:</strong>模型参数越多+训练数据越多+计算量越大,性能就越好——而且这种提升是可预测的。</p>
<p>OpenAI在2020年发现,语言模型的性能随参数量、数据量、计算量的增加呈幂律提升。这意味着"堆规模"是一条可靠的路,推动了从GPT-3的1750亿到更大模型的军备竞赛。</p>
<div class="warn">⚠️ 2024年起有研究表明传统Scaling Law可能触及瓶颈,推理时算力(Test-time Compute)成为新的扩展维度。</div>
</div>
<div class="dbox">
<h3>RLHF (人类反馈强化学习)</h3>
<p><strong>一句话理解:</strong>用人类的好恶来"训练"AI变得更有用、更安全、更符合人类价值观。</p>
<p>三步走:①收集人类标注员对AI输出的偏好排序;②训练一个奖励模型来预测人类评分;③用PPO强化学习优化语言模型,最大化奖励分数。ChatGPT之所以比GPT-3.5"好用得多",核心就是RLHF。</p>
</div>
<div class="dbox">
<h3>涌现能力 (Emergent Abilities)</h3>
<p><strong>一句话理解:</strong>随着模型规模增大,突然出现的、小模型完全没有的能力。</p>
<p>GPT-3之前,没有人预料到大语言模型会"自然而然"学会算术、翻译、写代码。这些能力不是专门训练出来的,而是在规模达到某个临界点后"涌现"的。这也是为什么每次大模型发布都会有惊喜。</p>
<div class="note">📊 典型涌现能力:多步推理、代码调试、类比推理、问题拆解——这些在70亿参数以下模型中几乎不存在,在700亿以上才明显出现。</div>
</div>
<div class="dbox">
<h3>MoE (混合专家模型)</h3>
<p><strong>一句话理解:</strong>一个模型里放多个"专家",每次只激活其中几个,大幅降低推理成本。</p>
<p>GPT-4、DeepSeek、Qwen3等顶尖模型都使用MoE架构。以DeepSeek-V3为例:总参数671B,但每次推理只激活约37B,实际计算量远低于Dense模型,使其在高性能的同时保持极低成本。</p>
</div>
<div class="dbox">
<h3>思维链推理 (Chain of Thought)</h3>
<p><strong>一句话理解:</strong>让AI先"想一想"再给答案,大幅提升复杂推理准确率。</p>
<p>普通模式:问题→答案。CoT模式:问题→一步步分析→答案。在数学竞赛、逻辑推理、代码调试等任务中,CoT能将准确率提升30-50%。OpenAI o1/o3就是将"长思考"作为核心能力推向极致的产品。</p>
</div>
</div>
<hr class="divider">
<div class="sec-title">🗺️ AI技术栈全景图</div>
<div class="sec-sub">从基础架构到应用落地——现代AI的完整技术体系</div>
<div class="dbox">
<h3>AI技术栈层次结构</h3>
<div style="display:grid;gap:10px;margin-top:12px">
<div style="background:rgba(59,130,246,.12);border:1px solid rgba(59,130,246,.3);border-radius:10px;padding:14px">
<div style="font-weight:600;color:#93c5fd;margin-bottom:6px">Layer 5 · 应用层(用户直接使用)</div>
<div style="font-size:13px;color:var(--muted)">ChatGPT · Claude · Gemini · 文心一言 · 通义千问 · Kimi · 豆包 · Copilot · Cursor · Dify应用</div>
</div>
<div style="background:rgba(139,92,246,.12);border:1px solid rgba(139,92,246,.3);border-radius:10px;padding:14px">
<div style="font-weight:600;color:#c4b5fd;margin-bottom:6px">Layer 4 · 框架层(开发者构建应用)</div>
<div style="font-size:13px;color:var(--muted)">LangChain · LlamaIndex · Dify · Coze · AutoGen · CrewAI · n8n · Flowise · Haystack</div>
</div>
<div style="background:rgba(6,182,212,.12);border:1px solid rgba(6,182,212,.3);border-radius:10px;padding:14px">
<div style="font-weight:600;color:#67e8f9;margin-bottom:6px">Layer 3 · 模型层(基础大模型)</div>
<div style="font-size:13px;color:var(--muted)">GPT-4o · Claude 3.7 · Gemini 2.0 · DeepSeek-R1 · Llama 4 · Qwen3 · Mistral · GLM-4</div>
</div>
<div style="background:rgba(16,185,129,.12);border:1px solid rgba(16,185,129,.3);border-radius:10px;padding:14px">
<div style="font-weight:600;color:#6ee7b7;margin-bottom:6px">Layer 2 · 数据与存储层</div>
<div style="font-size:13px;color:var(--muted)">向量数据库:Chroma · Milvus · Pinecone · Weaviate | 训练数据:Common Crawl · The Pile · ROOTS</div>
</div>
<div style="background:rgba(245,158,11,.12);border:1px solid rgba(245,158,11,.3);border-radius:10px;padding:14px">
<div style="font-weight:600;color:#fcd34d;margin-bottom:6px">Layer 1 · 算力基础设施层</div>
<div style="font-size:13px;color:var(--muted)">GPU/TPU:NVIDIA A100/H100/H200 · Google TPU v5 · 华为昇腾 | 云平台:AWS · Azure · GCP · 阿里云 · 腾讯云</div>
</div>
</div>
</div>
</div>
<footer>
<p>AI大模型全景培训手册 · 发展历史章节 · 2026年5月版</p>
<p><a href="manual.html">← 返回培训首页</a> | <a href="models.html">下一章:全部模型 →</a></p>
</footer>
</body>
</html>