智能進化:從邏輯推理到大模型的AI技術發展史
溫正
- 出版商: 化學工業
- 出版日期: 2026-09-01
- 售價: $480
- 語言: 簡體中文
- 頁數: 286
- ISBN: 7122509443
- ISBN-13: 9787122509444
-
相關分類:
Large language model
尚未上市,歡迎預購
商品描述
本書循序漸進地揭示了人工智能的技術演進與實際應用。首先從人工智能的早期理論入手,介紹了感知機、神經網絡及深度學習的關鍵節點,並結合統計語言模型和自然語言處理中的實際案例,解析了技術如何從理論走向實踐。隨後聚焦於大模型時代的突破,深入探討Transformer架構的出現及其後續模型(如BERT、GPT)的應用,同時延伸至微調與遷移學習的核心技術和多任務學習的實踐價值。最後結合硬件進步和多模態學習的發展,探討了人工智能如何在社會倫理、透明性與人機協作中與人類社會共存。
本書能夠幫助讀者全面了解人工智能從起源到未來的發展脈絡,掌握核心技術與前沿動態。通過系統化的結構和清晰的敘述,為人工智能研究者、從業者和愛好者搭建了學習路徑,既可以作為入門的理論指引,也能夠啟發讀者思考人工智能技術的社會價值和未來潛力。
目錄大綱
第1章 人工智能的誕生:從邏輯推理到初代神經網絡 002
1.1 圖靈測試與AI概念的提出 002
1.1.1 圖靈機的設計與計算理論的基石 002
1.1.2 圖靈測試的哲學與技術意義 004
1.2 早期專家系統的應用:Dendral與MYCIN 006
1.2.1 Dendral的知識工程與化學分析應用 006
1.2.2 MYCIN在醫療診斷中的邏輯推理 007
1.3 感知機模型的起源與局限性 008
1.3.1 感知機的原理與線性分類問題 009
1.3.2 XOR問題與感知機研究的暫停 011
1.4 神經網絡的首次爆發:Hopfield網絡與BP算法 012
1.4.1 Hopfield網絡的動態系統模型 013
1.4.2 BP算法的提出與多層網絡的訓練 015
1.5 冷戰時期的AI應用與研究瓶頸 017
1.5.1 軍事領域的AI探索:語言翻譯與控制系統 017
1.5.2 經費削減與“AI寒冬”的到來 018
第2章 機器學習的興起:從統計到算法 022
2.1 機器學習基礎:線性回歸與決策樹的應用 022
2.1.1 線性回歸的基本原理與應用場景 022
2.1.2 決策樹的劃分標準與信息增益 024
2.2 支持向量機與核方法的突破 028
2.2.1 SVM的數學幾何直觀與最大間隔原理 028
2.2.2 核方法的引入與非線性問題的解決 030
2.3 貝葉斯理論與概率圖模型的引入 032
2.3.1 貝葉斯定理基本原理與實際應用 033
2.3.2 馬爾可夫鏈與隱馬爾可夫模型 034
2.4 集成學習方法:Bagging、Boosting與Random Forest 037
2.4.1 Bagging的並行架構與隨機森林實現 037
2.4.2 Boosting的逐步優化與Adaboost算法 039
2.5 數據驅動的學習:機器學習的應用場景拓展 041
2.5.1 從數據到模型:語音識別的崛起 041
2.5.2 圖像分類任務中的機器學習應用 043
第3章 深度學習的萌芽:早期多層網絡的探索 049
3.1 神經網絡的覆興:從BP算法到多層感知機 049
3.1.1 BP算法的導數鏈規則與誤差反向傳播 050
3.1.2 多層感知機的架構與非線性激活函數 052
3.2 卷積神經網絡(CNN)的首次應用:LeNet與圖像識別 055
3.2.1 卷積操作與局部感受野 056
3.2.2 LeNet的架構與手寫數字識別應用 057
3.3 遞歸神經網絡(RNN)與時間序列建模 060
3.3.1 RNN的循環結構與梯度爆炸問題 060
3.3.2 時間序列預測的應用實例 062
3.4 自編碼器與生成模型的早期嘗試 063
3.4.1 自編碼器的對稱結構與數據壓縮 063
3.4.2 生成對抗網絡的雛形:能量模型探索 067
3.5 深度學習困境:梯度消失與計算資源瓶頸 068
3.5.1 梯度消失的數學分析與激活函數改進 068
3.5.2 硬件與數據限制對模型擴展的影響 069
第2篇 深度學習的崛起與大模型的發展
第4章 深度學習的崛起:從AlexNet到現代架構 074
4.1 AlexNet的革命性突破:ImageNet挑戰賽的勝利 074
4.1.1 ImageNet數據集的構建與關鍵意義 074
4.1.2 AlexNet的雙GPU架構與ReLU激活函數 077
4.2 Dropout、Batch Normalization等優化策略的提出 081
4.2.1 Dropout的隨機失活機制與正則化效果 082
4.2.2 Batch Normalization的歸一化過程與訓練加速 084
4.3 ResNet與Inception:深度學習網絡結構的演進 085
4.3.1 ResNet的殘差連接與深層網絡的優化 086
4.3.2 Inception模塊的並行卷積與參數優化 088
4.4 LSTM與GRU:序列數據建模的強化 091
4.4.1 LSTM的門控機制與長時依賴問題的解決 091
4.4.2 GRU的簡化架構與性能對比 095
4.5 深度學習在計算機視覺與語音識別中的應用爆發 097
4.5.1 圖像分類、目標檢測與分割的全面發展 097
4.5.2 語音識別系統的深度學習解決方案 102
第5章 大數據時代:AI與數據的共生關系 106
5.1 數據的規模與質量對AI的影響 106
5.1.1 數據規模對模型性能的提升作用 106
5.1.2 數據清洗與特征工程對模型優化的關鍵性 108
5.2 數據清洗與標註:高質量數據集的構建 110
5.2.1 噪聲數據的清洗 110
5.2.2 數據標註的自動化與眾包 112
5.3 開源數據集:CIFAR-100、IMDb與COCO 114
5.3.1 CIFAR-100圖像分類數據集 114
5.3.2 COCO數據集的多任務目標與使用場景 116
5.3.3 IMDb影評情感數據集 121
5.4 數據驅動AI的應用案例:廣告、推薦與搜索引擎 123
5.4.1 推薦系統中的用戶畫像與特征提取 123
5.4.2 搜索引擎中的文本索引與排序優化 128
5.5 數據隱私與倫理問題:大數據時代的挑戰 130
5.5.1 數據隱私保護的技術方法與法律框架 130
5.5.2 數據歧視與倫理問題的社會影響 131
第6章 自然語言處理的躍遷:從統計方法到Transformer 135
6.1 統計語言模型與詞嵌入方法:從n-gram到Word2Vec 135
6.1.1 n-gram語言模型的原理與應用 135
6.1.2 Word2Vec的連續詞袋模型與Skip-gram方法 137
6.2 Attention機制的提出與Seq2Seq架構的演化 138
6.2.1 Attention機制的原理與直觀理解 139
6.2.2 Seq2Seq架構及其翻譯任務中的應用 146
6.3 Transformer的誕生:Attention Is All You Need 149
6.3.1 Transformer架構的編碼器與解碼器模塊 150
6.3.2 多頭註意力與位置編碼 154
6.4 BERT與GPT的單、雙向語言建模 158
6.4.1 BERT的掩碼語言模型與預訓練過程 159
6.4.2 GPT的自回歸建模與生成任務應用 161
6.5 NLP應用的廣泛落地:翻譯、問答與生成式AI 165
6.5.1 神經網絡機器翻譯的演進與產業應用 165
6.5.2 生成式AI在內容創作與對話系統中的應用 166
第7章 大模型的誕生:從預訓練到微調 173
7.1 預訓練模型的理論基礎與優勢 173
7.1.1 預訓練-微調範式的提出與應用擴展 173
7.1.2 模型遷移學習的理論與實例 176
7.2 GPT系列與生成式AI模型的發展 178
7.2.1 GPT系列模型的規模增長與能力提升 178
7.2.2 大語言模型在文本生成任務中的具體實現 180
7.3 BERT、T5與多任務學習的實現 183
7.3.1 T5模型的文本轉化框架與多任務適配 183
7.3.2 多任務學習對預訓練模型性能的提升 185
7.4 微調與遷移學習:讓模型適應特定任務 187
7.4.1 微調方法的分類:凍結層與增量訓練 187
7.4.2 遷移學習在醫學文本與法律分析中的應用 188
7.5 模型規模與性能的權衡:參數量的意義 190
7.5.1 參數規模對模型推理能力的影響 190
7.5.2 模型壓縮與性能優化 192
第3篇 AI的技術融合與未來展望
第8章 AI硬件的突破:計算力與能效優化
8.1 GPU的崛起與並行計算在AI中的應用 196
8.1.1 GPU的架構特點與矩陣運算優化 196
8.1.2 CUDA編程模型在AI計算中的應用 198
8.2 TPU與ASIC:專用AI硬件的出現 200
8.2.1 TPU的加速邏輯與Google AI的部署 200
8.2.2 ASIC硬件的垂直優化與低功耗優勢 201
8.3 雲計算與分布式訓練技術的發展 202
8.3.1 雲端AI計算簡介 203
8.3.2 分布式訓練中的數據並行與模型並行 205
8.4 模型壓縮與量化:剪枝、蒸餾與低精度計算 207
8.4.1 模型剪枝與知識蒸餾理論簡介 207
8.4.2 低精度計算對推理性能的優化效果 210
8.5 算力與AI發展的相輔相成 213
8.5.1 算力規模對AI研究進展的推動作用 213
8.5.2 算力、算法與數據的動態平衡 215
第9章 跨模態與多模態的融合:視覺、語言與感知 218
9.1 多模態學習的理論基礎:信息的聯合表示 218
9.1.1 跨模態學習:嵌入與對齊 218
9.1.2 模態間的共享表示 222
9.2 圖像與文本結合的應用:CLIP與DALL·E 224
9.2.1 CLIP的對比學習架構與跨模態任務 224
9.2.2 文生圖模型:DALL·E 229
9.3 視覺-語言任務:VQA與跨模態檢索 231
9.3.1 VQA任務:視覺與語言融合技術 231
9.3.2 跨模態檢索模型架構 234
9.4 多模態感知的應用:自動駕駛與智能家居 236
9.4.1 自動駕駛中的多傳感器融合技術 236
9.4.2 智能家居場景中的多模態AI應用 245
9.5 跨模態的未來挑戰與研究方向 248
9.5.1 模態不平衡問題與數據稀缺性解決方案 248
9.5.2 跨模態研究的倫理與隱私問題 250
第10章 人工智能的未來:從技術突破到社會影響 253
10.1 強人工智能的技術路徑與哲學爭議 253
10.1.1 從窄人工智能到通用人工智能 253
10.1.2 強人工智能的倫理困境與哲學討論 258
10.2 人工智能倫理:公平性與透明性 260
10.2.1 算法偏見檢測與矯正技術 260
10.2.2 透明性與可解釋性 262
10.3 AI在工業、醫療與教育中的前瞻應用 265
10.3.1 工業領域中的智能自動化 265
10.3.2 AI輔助醫療診斷支持 266
10.3.3 AI輔助教育事業 272
10.4 人機協作的未來:增強智能的潛力 273
10.4.1 人工智能與人類認知的互補關系 273
10.4.2 增強智能在工作場景中的應用 274
10.5 可持續發展與人工智能的長期影響 276
10.5.1 AI可持續發展:能源消耗與環境影響 276
10.5.2 可持續AI的研究趨勢 277
附錄 人工智能發展時間線 281
