輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI

黃士嘉、張富順 著

  • 出版商: 博碩
  • 出版日期: 2026-10-02
  • 定價: $620
  • 售價: 7.8$483
  • 語言: 繁體中文
  • 頁數: 272
  • ISBN: 6264146331
  • ISBN-13: 9786264146333
  • 相關分類: Large language model
  • 尚未上市,歡迎預購

  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-1
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-2
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-3
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-4
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-5
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-6
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-7
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-8
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-9
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-10
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-11
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-12
  • 輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-13
輕鬆學會 RAG 實作開發:在 NVIDIA 微服務打造零幻覺的 LLM 與生成式 AI-preview-1

相關主題

商品描述

聚焦LLM關鍵技術,RAG觀念與實作並重



【內容簡介】
在生成式AI的浪潮下,檢索增強生成(Retrieval-Augmented GenerationRAG)已成為大型語言模型(LLM)的關鍵技術。由於LLM受限於訓練資料的時效性與涵蓋範圍,面對即時議題時容易引用過時知識,而在處理企業內部問題時,也常因缺乏私有數據而產生幻覺現象(Hallucination),為了改善上述問題,RAG技術應運而生,透過在生成答案前先從外部資料庫檢索相關資料,並提供給LLM作為回答依據,成為目前業界最主流的解決方案。

本書共分為6章,第0章完成開發環境建置,第15章依序帶入向量檢索增強生成(Vector RAG)、圖譜檢索增強生成(Graph RAG)、混合檢索增強生成(Hybrid RAG)、假想性文件嵌入(Hypothetical Document EmbeddingsHyDE)與代理檢索增強生成(Agentic RAG)。各章以深入淺出的方式,帶領讀者從零開始、循序漸進地學習RAG的基礎知識與運作原理,並以「圖書館智慧問答系統」為情境,透過NVIDIA NIM微服務取得免費LLM資源,並搭配Docker Desktop部署Milvus向量資料庫與Neo4j圖資料庫進行實務開發,讓讀者觀念與實作並重,在短時間內快速上手。
 

【精彩內容】
完成開發環境建置:在Windows 11安裝PythonDocker DesktopVS Code,完成NVIDIA NIM帳號註冊、API Key申請與模型挑選,並學習GitGitHub版本控制的基本操作。
認識檢索增強生成(RAG:瞭解LLM在未整合RAG時常見的幻覺現象(Hallucination)、引用過時知識、缺乏企業私有數據等問題。
認識向量檢索增強生成(Vector RAG:瞭解Vector RAG是如何突破傳統「關鍵字字面比對」的限制,改以語意檢索(Semantic Search)找出語意相關的資料。
認識圖譜檢索增強生成(Graph RAG:瞭解Graph RAG是如何透過三個主要階段,將外部文件轉化為可查詢的知識圖譜,並從中檢索與使用者提問相關的實體關聯脈絡。
認識混合檢索增強生成(Hybrid RAG:瞭解Vector RAGGraph RAG在檢索架構上的優缺點。
認識假想性文件嵌入(HyDE:瞭解HyDE是如何透過LLM生成假想文件,縮短使用者問題與文件片段間的語意落差,進而提升檢索精準度。
認識代理檢索增強生成(Agentic RAG:瞭解AI Agent是如何運用工具(Tool)、技能(Skill)與ReAct迴圈,自主完成檢索任務。
 

作者簡介

黃士嘉
經歷:國立臺北科技大學電子工程系 特聘教授、加拿大 McGill University 國際客座教授、加拿大 Ontario Tech University 國際客座教授、IEEE Transactions on Intelligent Vehicles 國際副主編、IEEE Sensors Journal 國際副主編
獲獎:經濟部第 5 屆國家產業創新獎、ACM臺灣分會李國鼎研究獎、史丹福大學世界 2%頂尖科學家、國立臺北科技大學 校傑出研究獎、國立臺北科技大學 電資學院院傑出研究獎

張富順
學歷:國立臺北科技大學電子工程系碩士

目錄大綱

|CHAPTER 00| 環境安裝
0.1 前言
0.2 Python安裝
0.3 Docker安裝
0.4 VS Code安裝
0.5 NVIDIA NIM帳號註冊
0.6 NVIDIA NIM API KEY申請
0.7 NVIDIA NIM挑選模型
0.8 版本控制工具

|CHAPTER 01| 向量檢索增強生成
1.1 檢索增強生成
1.2 向量檢索增強生成
1.3 實驗:向量檢索增強生成

|CHAPTER 02| 圖譜檢索增強生成
2.1 圖譜檢索增強生成
2.2 實驗:圖譜檢索增強生成

|CHAPTER 03| 混合檢索增強生成
3.1 混合檢索增強生成
3.2 實驗:混合檢索增強生成

|CHAPTER 04| 假想性文件嵌入
4.1 假想性文件嵌入
4.2 實驗:假想性文件嵌入

 
|CHAPTER 05| 代理檢索增強生成
5.1 AI代理人
5.2 代理檢索增強生成
5.3 實驗:代理檢索增強生成