剖析大語言模型

申富饒

  • 出版商: 機械工業
  • 出版日期: 2026-08-01
  • 售價: $534
  • 語言: 簡體中文
  • ISBN: 7111813030
  • ISBN-13: 9787111813033
  • 相關分類: Large language model
  • 下單後立即進貨 (約4週~6週)

商品描述

本書是大語言模型的入門書籍,共分為7章,內容由淺入深、邏輯清晰。開篇從大語言模型的基本定義、發展脈絡與技術演進講起,細致拆解Transformer核心架構;隨後依次講解自監督預訓練原理、模型高效微調技術、檢索增強生成(RAG)框架,以及高質量數據體系構建方法; 梳理當前主流開源大模型,詳解多個實戰項目,為讀者搭建起清晰的大語言模型學習路徑。

作者簡介

申富饒,教授,博士生導師,擔任計算機軟件新技術 重點實驗室、南京大學人工智能學院、南京大學計算機科學與技術系教授。擔任南京大學教學委員會委員,南京大學人工智能學院院長助理,負責南京大學人工智能學院的教學和人才培養工作。在南京大學數學系取得學士、碩士學位,在日本東京工業大學智能系統科學專業取得博士學位。兼任南京大學量子物理與人工智能特聘教授、南京大學科沃斯講席教授,入選“創業南京”科技 專家集聚計劃A類專家,擔任南京智能制造軟件新技術研究院首席科學家,是中國計算機學會系統軟件專委會委員、 會員,江蘇省計算機學會理事、組織工委主任,歷任日本科學振興機構研究員、日本學術振興會外國人特別研究員等。主要研究方向包括神經網絡、計算機視覺、機器人智能,主持或參加過 自然科學基金、973、 重點實驗室專項研究基金等 項目以及 、科技部、江蘇省自然科學基金等省部級項目,在 外包括IJCAI、AAAI、CVPR、ATC、FSE等 會議和IEEE TIP、IEEE TNNLS、Neural Networks等領域內 SCI期刊上發表學術論文120餘篇,其中被SCI、EI、ISTP收錄的論文100餘篇,多次擔任 會議分會 、程序委員會委員,是多個知名 期刊的審稿人,擁有20餘項 發明專利和4項 發明專利,出版專著及譯著6部。