用 Python 實作強化學習|使用 TensorFlow 與 OpenAI Gym (Hands-On Reinforcement Learning with Python)
Sudharsan Ravichandiran
- 出版商: 碁峰資訊 參展書2書75折
- 出版日期: 2019-05-29
- 定價: $520
- 售價: 7.9 折 $410
- 語言: 繁體中文
- 頁數: 328
- ISBN: 9865021412
- ISBN-13: 9789865021412
-
相關分類:
Reinforcement
- 此書翻譯自: Hands-On Reinforcement Learning with Python: Master reinforcement and deep reinforcement learning using OpenAI Gym and TensorFlow
立即出貨(限量) (庫存=3)
買這商品的人也買了...
-
資料結構 -- 使用 Python$520$410 -
$957深度學習 -
演算法圖鑑:26種演算法 + 7種資料結構,人工智慧、數據分析、邏輯思考的原理和應用 step by step 全圖解$450$270 -
Python 資料科學學習手冊 (Python Data Science Handbook: Essential Tools for Working with Data)$780$616 -
$402深入淺出強化學習 : 原理入門 -
$408強化學習精要:核心算法與 TensorFlow 實現 -
最新人工智慧應用:用強化學習快速上手 AI$580$493 -
比 Tensorflow 還精美的人工智慧套件:PyTorch 讓你愛不釋手$620$527 -
白話深度學習與 TensorFlow$480$379 -
Python 技術者們 - 實踐! 帶你一步一腳印由初學到精通$650$552 -
$351Python 強化學習實戰 : 應用 OpenAI Gym 和 TensorFlow 精通強化學習和深度強化學習 -
深度學習入門教室:6堂基礎課程 + Python 實作練習,Deep Learning、人工智慧、機器學習的理論和應用全圖解$550$495 -
Deep Learning 2|用 Python 進行自然語言處理的基礎理論實作$680$537 -
Python 機器學習與深度學習特訓班:看得懂也會做的 AI人工智慧實戰 (附120分鐘影音教學/範例程式)$520$410 -
Deep learning 深度學習必讀 - Keras 大神帶你用 Python 實作 (Deep Learning with Python)$1,000$790 -
$402統計強化學習:現代機器學習方法 (Statistical Reinforcement Learning: Modern Machine Learning Approaches) -
超圖解 Python 程式設計入門$650$553 -
實戰人工智慧之深度強化學習|使用 PyTorch x Python$500$395 -
強化學習:原理與Python實現$534$507 -
$856強化學習, 2/e (Reinforcement Learning: An Introduction, 2/e) -
$504白話強化學習與 PyTorch -
動手做深度強化學習 (Deep Reinforcement Learning Hands-On)$690$538 -
非監督式學習|使用 Python (Hands-On Unsupervised Learning Using Python)$680$537 -
深度學習的數學:用數學開啟深度學習的大門$500$425 -
深度強化式學習 (Deep Reinforcement Learning in Action)$1,000$790
碁峰書展|參展書2書75折 詳見活動內容 »
-
79折
不用自己寫!用 GitHub Copilot 搞定 LLM 應用開發$600$474 -
79折
內行人才知道的系統設計面試指南$580$458 -
79折
提升程式設計師的面試力|189道面試題目與解答, 6/e (修訂版) (Cracking the Coding Interview : 189 Programming Questions and Solutions, 6/e)$980$774 -
79折
Software Architecture in Practice, 4/e (繁體中文版)$780$616 -
79折
內行人才知道的系統設計面試指南 第二輯 (System Design Interview – An Insider's Guide: Volume 2)$820$647 -
79折
敏捷團隊目標設定指南|OKR 落地與成果導向實踐法$500$395 -
79折
內行人才知道的物件導向設計面試指南$690$545 -
79折
內行人才知道的生成式 AI 系統設計面試指南 (Generative AI System Design Interview)$750$592 -
75折
團隊自省指南|打造敏捷團隊$500$375 -
79折
Arduino 自走車最佳入門與應用 -- 打造輪型機器人輕鬆學, 2/e$600$474 -
79折
凡人也能懂的白話人工智慧演算法 (Grokking Artificial Intelligence Algorithms)$580$458 -
79折
戰勝 C語言, 3/e$600$474 -
79折
內行人才知道的程式設計模式面試指南 (Coding Interview Patterns: Nail Your Next Coding Interview)$780$616 -
79折
SQL Server 2025/2022 資料庫設計與開發實務$700$553 -
79折
AI 超神簡報術:NotebookLM × Gemini × Gamma 全解鎖 (附範例素材/提示詞/影音教學)$550$434 -
79折
Python 初學特訓班:從快速入門、主流應用到 AI 全面實戰, 6/e (附超過500分鐘影音教學/範例程式)$490$387 -
79折
重構|改善既有程式的設計, 2/e (繁中平裝版)(Refactoring: Improving The Design of Existing Code, 2/e)$800$632 -
79折
Python 自動化的樂趣|搞定重複瑣碎&單調無聊的工作, 3/e (Automate the Boring Stuff with Python, 3/e)$980$774 -
79折
Visual C# 2026 超級必修課:ChatGPT 與 Copilot 協作、Azure OpenAI 實戰開發$580$458 -
75折
ChatGPT 5 實戰應用:提問技巧、資料解析、圖像生成、語音助理、工作自動化、跨工具整合$500$375 -
75折
深入 Linux Kernel 程式設計:kernel 內部原理、模組開發與同步機制, 2/e (Linux Kernel Programming : A comprehensive and practical guide to kernel internals, writing modules, and kernel synchronization, 2/e)$980$735 -
79折
內行人才知道的機器學習系統設計面試指南 (Machine Learning System Design Interview)$680$537 -
5折
戰勝 C語言, 2/e (過版書特價)$580$290 -
79折
AI 提問 X 學習 X 應用:ChatGPT、NotebookLM、Gemini、GitHub Copilot,從零到 AI Agent 實戰$390$308 -
79折
Code That Fits in Your Head|軟體工程的啟發式方法$580$458
相關主題
商品描述
強化學習可說是能自我演進的機器學習,能帶領我們達到真正的人工智慧。本書好讀又容易上手,運用了大量Python範例來從頭解釋所有東西。
本書從強化學習的簡介開始,接著是OpenAI Gym與TensorFlow。您會認識各種RL演算法與重要觀念,例如Markov決策過程、蒙地卡羅法與動態規劃,包括價值迭代與策略迭代。本書提供了非常豐富的範例幫助您認識各種深度強化學習演算法,例如競爭DQN、DRQN、A3C、PPO與TRPO。您還會學到想像增強代理、透過人類偏好來學習、DQfD、HER以及更多強化學習的最新發展。
本書精彩內容:
.理解強化學習方法、演算法與重要元素的相關基礎
.使用OpenAI Gym與TensorFlow來訓練代理
.理解Markov決策過程、Bellman最佳化與TD學習
.運用多種演算法來解決多臂式吃角子老虎問題
.熟悉各種深度學習演算法,如RNN、LSTM、CNN與其應用
.使用DRQN演算法來建置智能代理來玩毀滅戰士遊戲
.使用DDPG來教導代理來玩月球冒險遊戲
.使用競爭DQN來訓練代理來玩賽車遊戲
作者簡介
Sudharsan Ravichandiran是位資料科學家、研究者、人工智慧狂熱者與YouTuber(請搜尋Sudharsan reinforcement learning),在Anna大學取得資訊科技學士學位,研究領域是深度學習與強化學習的實務性實作,包含字元語言處理與電腦視覺。
目錄大綱
第一章|認識強化學習
介紹何謂強化學習以及其運作原理。介紹強化學習的各種元素,如代理、環境、策略與模型,並帶領讀者認識用於強化學習的各種環境、平台與函式庫,以及強化學習的一些應用。
第二章|認識OpenAI與TensorFlow
建置使用強化學習的電腦環境,包括Anaconda、Docker、OpenAI Gym、Universe與TensorFlow的安裝設定,並說明如何在OpenAI Gym中來模擬代理,以及如何建置一個會玩電玩遊戲的機器人程式。另外也會解說TensorFlow的基礎觀念以及如何使用TensorBoard來進行視覺化操作。
第三章|Markov決策過程與動態規劃
從介紹何謂Markov鍊與Markov流程開始,說明如何使用Markov決策流程來對強化學習問題來建模。接著是一些重要的基本概念,例如價值函數、Q函數與Bellman方程式。然後介紹動態規劃以及如何運用價值迭代與策略迭代來解決凍湖問題。
第四章|使用Monte Carlo方法來玩遊戲
介紹了Monte Carlo法與不同類型的 Monte Carlo預測法,如首次拜訪MC與每次拜訪MC,並說明如何使用Monte Carlo法來玩二十一點這項撲克牌遊戲。最後會介紹現時與離線這兩種不同的Monte Carlo控制方法。
第五章|時間差分學習
介紹時間差分(TD)學習、TD預測與TD的即時/離線控制法,如Q學習與SARSA。並說明如何使用Q學習與SARSA來解決計程車載客問題。
第六章|多臂式吃角子老虎機問題
要討論的是強化學習的經典問題:多臂式吃角子老虎機(MAB)問題,也稱為k臂式吃角子老虎機(MAB)問題。介紹如何使用各種探索策略來解決這個問題,例如epsilon-貪婪、softmax探索、UCB與湯普森取樣。本章後半也會介紹如何運用MAB來對使用者顯示正確的廣告橫幅。
第七章|深度學習的基礎概念
介紹深度學習的重要觀念。首先,說明何謂神經網路,接著是不同類型的神經網路,如RNN、LSTM與CNN等。本章將實作如何自動產生歌詞與分類時尚產品。
第八章|使用深度Q網路來玩Atari遊戲
介紹了一套最常用的深度強化學習演算法:深度Q網路(DQN)。接著介紹DQN的各個元件,並說明如何運用DQN來建置代理來玩Atari遊戲。最後介紹一些新型的DQN架構,如雙層DQN與競爭DQN。
第九章|使用深度循環Q網路來玩毀滅戰士
介紹深度循環Q網路(DRQN),並說明它與DQN的差異。本章會運用DRQN來建置代理來玩毀滅戰士遊戲。同時介紹深度專注循環Q網路,它在DRQN架構中加入了專注機制。
第十章|非同步優勢動作評價網路
介紹了非同步優勢動作評價網路(A3C)的運作原理。我們將帶領你深入了解A3C的架構並學會如何用它來建置會爬山的代理。
第十一章|策略梯度與最佳化
說明策略梯度如何在不需要Q函數的前提下,幫助我們找到正確的策略。同時還會介紹深度確定性策略梯度法,以及最新的策略最佳化方法,如信賴域策略最佳化與近端策略最佳化。
第十二章 使用DQN來玩賽車遊戲
本章將帶領你運用競爭DQN來建置代理,讓它學會玩賽車遊戲。
第十三章 近期發展與下一步
介紹強化學習領域中的各種最新發展,例如想像增強代理、從人類偏好來學習、由示範來進行的深度Q學習以及事後經驗回放等等,然後談到了不同的強化學習方法,如層次強化學習與逆向強化學習。









