智能進化:從邏輯推理到大模型的AI技術發展史

溫正

  • 出版商: 化學工業
  • 出版日期: 2026-09-01
  • 售價: $480
  • 語言: 簡體中文
  • 頁數: 286
  • ISBN: 7122509443
  • ISBN-13: 9787122509444
  • 相關分類: Large language model
  • 尚未上市,歡迎預購

商品描述

本書循序漸進地揭示了人工智能的技術演進與實際應用。首先從人工智能的早期理論入手,介紹了感知機、神經網絡及深度學習的關鍵節點,並結合統計語言模型和自然語言處理中的實際案例,解析了技術如何從理論走向實踐。隨後聚焦於大模型時代的突破,深入探討Transformer架構的出現及其後續模型(如BERT、GPT)的應用,同時延伸至微調與遷移學習的核心技術和多任務學習的實踐價值。最後結合硬件進步和多模態學習的發展,探討了人工智能如何在社會倫理、透明性與人機協作中與人類社會共存。
本書能夠幫助讀者全面了解人工智能從起源到未來的發展脈絡,掌握核心技術與前沿動態。通過系統化的結構和清晰的敘述,為人工智能研究者、從業者和愛好者搭建了學習路徑,既可以作為入門的理論指引,也能夠啟發讀者思考人工智能技術的社會價值和未來潛力。

目錄大綱

第1章 人工智能的誕生:從邏輯推理到初代神經網絡    002
1.1 圖靈測試與AI概念的提出    002
1.1.1 圖靈機的設計與計算理論的基石    002
1.1.2 圖靈測試的哲學與技術意義    004
1.2 早期專家系統的應用:Dendral與MYCIN    006
1.2.1 Dendral的知識工程與化學分析應用    006
1.2.2 MYCIN在醫療診斷中的邏輯推理    007
1.3 感知機模型的起源與局限性    008
1.3.1 感知機的原理與線性分類問題    009
1.3.2 XOR問題與感知機研究的暫停    011
1.4 神經網絡的首次爆發:Hopfield網絡與BP算法    012
1.4.1 Hopfield網絡的動態系統模型    013
1.4.2 BP算法的提出與多層網絡的訓練    015
1.5 冷戰時期的AI應用與研究瓶頸    017
1.5.1 軍事領域的AI探索:語言翻譯與控制系統    017
1.5.2 經費削減與“AI寒冬”的到來    018

第2章 機器學習的興起:從統計到算法    022
2.1 機器學習基礎:線性回歸與決策樹的應用    022
2.1.1 線性回歸的基本原理與應用場景    022
2.1.2 決策樹的劃分標準與信息增益    024
2.2 支持向量機與核方法的突破    028
2.2.1 SVM的數學幾何直觀與最大間隔原理    028
2.2.2 核方法的引入與非線性問題的解決    030
2.3 貝葉斯理論與概率圖模型的引入    032
2.3.1 貝葉斯定理基本原理與實際應用    033
2.3.2 馬爾可夫鏈與隱馬爾可夫模型    034
2.4 集成學習方法:Bagging、Boosting與Random Forest    037
2.4.1 Bagging的並行架構與隨機森林實現    037
2.4.2 Boosting的逐步優化與Adaboost算法    039
2.5 數據驅動的學習:機器學習的應用場景拓展    041
2.5.1 從數據到模型:語音識別的崛起    041
2.5.2 圖像分類任務中的機器學習應用    043

第3章 深度學習的萌芽:早期多層網絡的探索    049
3.1 神經網絡的覆興:從BP算法到多層感知機    049
3.1.1 BP算法的導數鏈規則與誤差反向傳播    050
3.1.2 多層感知機的架構與非線性激活函數    052
3.2 卷積神經網絡(CNN)的首次應用:LeNet與圖像識別    055
3.2.1 卷積操作與局部感受野    056
3.2.2 LeNet的架構與手寫數字識別應用    057
3.3 遞歸神經網絡(RNN)與時間序列建模    060
3.3.1 RNN的循環結構與梯度爆炸問題    060
3.3.2 時間序列預測的應用實例    062
3.4 自編碼器與生成模型的早期嘗試    063
3.4.1 自編碼器的對稱結構與數據壓縮    063
3.4.2 生成對抗網絡的雛形:能量模型探索    067
3.5 深度學習困境:梯度消失與計算資源瓶頸    068
3.5.1 梯度消失的數學分析與激活函數改進    068
3.5.2 硬件與數據限制對模型擴展的影響    069


第2篇 深度學習的崛起與大模型的發展
第4章 深度學習的崛起:從AlexNet到現代架構    074
4.1 AlexNet的革命性突破:ImageNet挑戰賽的勝利    074
4.1.1 ImageNet數據集的構建與關鍵意義    074
4.1.2 AlexNet的雙GPU架構與ReLU激活函數    077
4.2 Dropout、Batch Normalization等優化策略的提出    081
4.2.1 Dropout的隨機失活機制與正則化效果    082
4.2.2 Batch Normalization的歸一化過程與訓練加速    084
4.3 ResNet與Inception:深度學習網絡結構的演進    085
4.3.1 ResNet的殘差連接與深層網絡的優化    086
4.3.2 Inception模塊的並行卷積與參數優化    088
4.4 LSTM與GRU:序列數據建模的強化    091
4.4.1 LSTM的門控機制與長時依賴問題的解決    091
4.4.2 GRU的簡化架構與性能對比    095
4.5 深度學習在計算機視覺與語音識別中的應用爆發    097
4.5.1 圖像分類、目標檢測與分割的全面發展    097
4.5.2 語音識別系統的深度學習解決方案    102

第5章 大數據時代:AI與數據的共生關系    106
5.1 數據的規模與質量對AI的影響    106
5.1.1 數據規模對模型性能的提升作用    106
5.1.2 數據清洗與特征工程對模型優化的關鍵性    108
5.2 數據清洗與標註:高質量數據集的構建    110
5.2.1 噪聲數據的清洗    110
5.2.2 數據標註的自動化與眾包    112
5.3 開源數據集:CIFAR-100、IMDb與COCO    114
5.3.1 CIFAR-100圖像分類數據集    114
5.3.2 COCO數據集的多任務目標與使用場景    116
5.3.3 IMDb影評情感數據集    121
5.4 數據驅動AI的應用案例:廣告、推薦與搜索引擎    123
5.4.1 推薦系統中的用戶畫像與特征提取    123
5.4.2 搜索引擎中的文本索引與排序優化    128
5.5 數據隱私與倫理問題:大數據時代的挑戰    130
5.5.1 數據隱私保護的技術方法與法律框架    130
5.5.2 數據歧視與倫理問題的社會影響    131

第6章 自然語言處理的躍遷:從統計方法到Transformer    135
6.1 統計語言模型與詞嵌入方法:從n-gram到Word2Vec    135
6.1.1 n-gram語言模型的原理與應用    135
6.1.2 Word2Vec的連續詞袋模型與Skip-gram方法    137
6.2 Attention機制的提出與Seq2Seq架構的演化    138
6.2.1 Attention機制的原理與直觀理解    139
6.2.2 Seq2Seq架構及其翻譯任務中的應用    146
6.3 Transformer的誕生:Attention Is All You Need    149
6.3.1 Transformer架構的編碼器與解碼器模塊    150
6.3.2 多頭註意力與位置編碼    154
6.4 BERT與GPT的單、雙向語言建模    158
6.4.1 BERT的掩碼語言模型與預訓練過程    159
6.4.2 GPT的自回歸建模與生成任務應用    161
6.5 NLP應用的廣泛落地:翻譯、問答與生成式AI    165
6.5.1 神經網絡機器翻譯的演進與產業應用    165
6.5.2 生成式AI在內容創作與對話系統中的應用    166

第7章 大模型的誕生:從預訓練到微調    173
7.1 預訓練模型的理論基礎與優勢    173
7.1.1 預訓練-微調範式的提出與應用擴展    173
7.1.2 模型遷移學習的理論與實例    176
7.2 GPT系列與生成式AI模型的發展    178
7.2.1 GPT系列模型的規模增長與能力提升    178
7.2.2 大語言模型在文本生成任務中的具體實現    180
7.3 BERT、T5與多任務學習的實現    183
7.3.1 T5模型的文本轉化框架與多任務適配    183
7.3.2 多任務學習對預訓練模型性能的提升    185
7.4 微調與遷移學習:讓模型適應特定任務    187
7.4.1 微調方法的分類:凍結層與增量訓練    187
7.4.2 遷移學習在醫學文本與法律分析中的應用    188
7.5 模型規模與性能的權衡:參數量的意義    190
7.5.1 參數規模對模型推理能力的影響    190
7.5.2 模型壓縮與性能優化    192


第3篇 AI的技術融合與未來展望
第8章 AI硬件的突破:計算力與能效優化
8.1 GPU的崛起與並行計算在AI中的應用    196
8.1.1 GPU的架構特點與矩陣運算優化    196
8.1.2 CUDA編程模型在AI計算中的應用    198
8.2 TPU與ASIC:專用AI硬件的出現    200
8.2.1 TPU的加速邏輯與Google AI的部署    200
8.2.2 ASIC硬件的垂直優化與低功耗優勢    201
8.3 雲計算與分布式訓練技術的發展    202
8.3.1 雲端AI計算簡介    203
8.3.2 分布式訓練中的數據並行與模型並行    205
8.4 模型壓縮與量化:剪枝、蒸餾與低精度計算    207
8.4.1 模型剪枝與知識蒸餾理論簡介    207
8.4.2 低精度計算對推理性能的優化效果    210
8.5 算力與AI發展的相輔相成    213
8.5.1 算力規模對AI研究進展的推動作用    213
8.5.2 算力、算法與數據的動態平衡    215

第9章 跨模態與多模態的融合:視覺、語言與感知    218
9.1 多模態學習的理論基礎:信息的聯合表示    218
9.1.1 跨模態學習:嵌入與對齊    218
9.1.2 模態間的共享表示    222
9.2 圖像與文本結合的應用:CLIP與DALL·E    224
9.2.1 CLIP的對比學習架構與跨模態任務    224
9.2.2 文生圖模型:DALL·E    229
9.3 視覺-語言任務:VQA與跨模態檢索    231
9.3.1 VQA任務:視覺與語言融合技術    231
9.3.2 跨模態檢索模型架構    234
9.4 多模態感知的應用:自動駕駛與智能家居    236
9.4.1 自動駕駛中的多傳感器融合技術    236
9.4.2 智能家居場景中的多模態AI應用    245
9.5 跨模態的未來挑戰與研究方向    248
9.5.1 模態不平衡問題與數據稀缺性解決方案    248
9.5.2 跨模態研究的倫理與隱私問題    250

第10章 人工智能的未來:從技術突破到社會影響    253
10.1 強人工智能的技術路徑與哲學爭議    253
10.1.1 從窄人工智能到通用人工智能    253
10.1.2 強人工智能的倫理困境與哲學討論    258
10.2 人工智能倫理:公平性與透明性    260
10.2.1 算法偏見檢測與矯正技術    260
10.2.2 透明性與可解釋性    262
10.3 AI在工業、醫療與教育中的前瞻應用    265
10.3.1 工業領域中的智能自動化    265
10.3.2 AI輔助醫療診斷支持    266
10.3.3 AI輔助教育事業    272
10.4 人機協作的未來:增強智能的潛力    273
10.4.1 人工智能與人類認知的互補關系    273
10.4.2 增強智能在工作場景中的應用    274
10.5 可持續發展與人工智能的長期影響    276
10.5.1 AI可持續發展:能源消耗與環境影響    276
10.5.2 可持續AI的研究趨勢    277


附錄 人工智能發展時間線    281