買這商品的人也買了...
-
PHP 動態網站系統開發與 Laravel 框架運用$580$493 -
$473機器學習算法評估實戰 (全彩印刷) -
Python 資料科學與機器學習:從入門到實作必備攻略 (Hands-On Data Science and Machine Learning with Python)$650$552 -
Python 大數據特訓班:資料自動化收集、整理、清洗、儲存、分析與應用實戰, 3/e (附320分鐘影音/範例程式)$520$410 -
$327漫畫Python數據分析 -
史上最強 Python 入門邁向頂尖高手 - 王者歸來, 4/e (全彩印刷)$1,200$948 -
機器學習 — 從線性回歸到大模型$312$296 -
商務大數據分析:案例分析與 AI 應用趨勢, 2/e$450$405 -
$1,524概率機器學習(進階篇)
簡體書新到貨|2書75折 (8/25--8/31) 詳見活動內容 »
-
VIP 95折
量子計算與人工智能$648$615 -
VIP 95折
圖解Skill+OpenClaw:零代碼打造你的AI智能助手$414$393 -
VIP 95折
OpenClaw快速上手極簡部署與實戰$299$284 -
VIP 95折
LangChain與大語言模型應用開發實踐$299$284 -
85折
$1,014系統安全工程導論 -
85折
$351機器人學基礎 第4版 -
85折
$254國產龍蝦實操手冊:12款OpenClaw國產AI工具零基礎入門+全場景應用(視頻教學版) -
85折
$606openvela輕量系統開發實戰 -
85折
$504智能網聯汽車:AUTOSAR Adaptive平臺技術體系與應用指南 -
VIP 95折
智能體的超級大腦:大模型工作原理揭秘$359$341 -
VIP 95折
30天輕松學會SQL$599$569 -
VIP 95折
大模型賦能的智能體系統原理與實踐$299$284 -
VIP 95折
先進智能感知技術與應用$1,008$957 -
VIP 95折
視覺智能 — 技術前沿與應用探索$894$849 -
VIP 95折
分布式數據庫系統:原理解析與架構設計$474$450 -
VIP 95折
理解深度學習$534$507 -
VIP 95折
AI 優先:面向未來的企業和品牌行動指南$414$393 -
VIP 95折
玩賺 AI 短視頻 : DeepSeek + 即夢 + 剪映 打造爆款視頻$474$450 -
VIP 95折
飛書雲端安全養蝦 極簡OpenClaw實操手冊$479$455 -
VIP 95折
雲網融合的新型網絡架構$594$564 -
VIP 95折
Seedance創富手冊:零基礎做電商帶貨和自媒體$474$450 -
VIP 95折
Python辦公自動化:基於銀河麒麟(Kylin)系統的實現方法$414$393 -
VIP 95折
自然語言處理實踐:語義理解與信息抽取$534$507 -
VIP 95折
大模型應用$354$336 -
VIP 95折
生成式大模型項目實戰(微課版)$359$341
相關主題
商品描述
《利用Python學習數據分析》用通俗易懂的文字結合大量代碼,詳細介紹了用Python進行數據分析的基本方法和技巧。全書共7章,具體內容包括數據分析的基礎知識,Python與數據分析程序庫,使用統計分析方法進行多維變量分析——相關分析/關聯分析/回歸分析/主成分分析/因子分析,使用機器學習算法進行多維變量分析——聚類分析/k-近鄰算法/決策樹/支持向量機,關聯分析,時間序列數據分析和網絡分析等。讀者可以一邊學習Python編程的基礎,一邊掌握數據分析的實踐技術。 《利用Python學習數據分析》內容豐富,實踐性強,適合大中專院校財務、人工智能、數據科學等相關專業學生學習,也適合作為讀者學習數據分析技術的參考用書。
作者簡介
山內長承,1975年畢業於東京大學工學部電子工學專業。1977年完成工學專業課程碩士課程。1978年進入斯坦福大學電氣工學專業,1984年退出博士課程,進入日本艾比·艾姆東京基礎研究所工作。2000年加入到東邦大學理學部情報科學科,任東邦大學理學部情報科學科教授。
目錄大綱
第1章 數據分析的基礎知識
1.1 數據分析簡介
1.2 變量與數據類型
1.3 分析方法概述
第2章 Python與數據分析程序庫
2.1 Python簡介
2.1.1 為什麼使用Python
2.1.2 Python與其他編程語言的區別
2.2 運行環境與JupyterNotebook
2.2.1 下載和安裝
2.2.2 使用JupyterNotebook
2.2.3 保存文件以及退出JupyterNotebook環境
2.3 數據分析程序庫NumPy、pandas與機器學習庫scikit-learn
2.3.1 NumPy
2.3.2 pandas
2.3.3 scikit-learn
2.4 可視化繪圖程序庫Matplotlib
2.4.1 繪圖
代碼2-1 繪制冰激淩消費支出與氣溫之間的關系圖(1)
代碼2-2 繪制冰激淩消費支出與氣溫之間的關系圖(2)
2.4.2 用繪圖方式表示兩個變量之間的關系
代碼2-3 繪制冰激淩消費支出與氣溫之間的關系圖(3)
代碼2-4 繪制冰激淩消費支出與氣溫之間的關系圖(4)
2.5 數據訪問
2.5.1 CSV文件的讀寫方法
2.5.2 用SQL讀寫數據庫數據
代碼2-5 通過MySQL讀取數據
代碼2-6 通過MySQL插入數據
代碼2-7 在pandas中進行數據處理
代碼2-8 在數據庫中用SQL進行數據處理
2.6 處理缺失數據
2.6.1 缺失數據的表示方法
2.6.2 檢測缺失值
2.6.3 刪除和置換缺失值
第3章 使用統計分析方法進行多維度變量分析——相關分析/關聯分析/回歸分析/主成分分析/因子分析
3.1 相關分析與回歸分析
3.1.1 相關分析
案例3-1 2016年平均氣溫與每個家庭的冰激淩月消費支出金額
代碼3-1 冰激淩月消費支出與平均氣溫之間的相關系數
3.1.2 回歸分析
代碼3-2 計算冰激淩消費支出與氣溫之間的回歸方程式(使用Scipy模塊中的stats.linregress函數)
代碼3-3 計算冰激淩消費支出與氣溫之間的回歸方程式(使用scikit-learn的linear_model模塊)
代碼3-4 根據冰激淩消費支出和氣溫數據計算回歸方程式(使用StatsModels的api.OLS模塊)
3.1.3 多元回歸分析
案例3-2 對波士頓房價進行多元回歸分析
代碼3-5 使用scikit-learn的linear_model模塊進行多元回歸分析(波士頓房價)
3.2 分類數據的關聯分析
3.2.1 φ系數
代碼3-6 使用奈坦尼克號乘客數據計算異變量之間的相關性
代碼3-7 對蘋果和橘子的喜好程度的相關性
3.2.2 古德-克魯斯卡爾γ系數和肯德爾τ系數
代碼3-8 計算肯德爾τ系數
代碼3-9 根據列表中每個單元格的值計算肯德爾τ系數
代碼3-10 使用scipy.stats.kendalltau計算肯德爾τ系數
3.2.3 χ2檢驗與克萊姆相關系數V
3.2.4 斯皮爾曼等級相關系數
代碼3-11 計算斯皮爾曼等級相關系數
3.3 主成分分析
案例3-3 費希爾的鳶尾花數據主成分分析
代碼3-12 根據費希爾的鳶尾花數據繪制花瓣長度和寬度的散點圖
代碼3-13 費希爾的鳶尾花數據集的主成分分析
代碼3-14 對費希爾鳶尾花數據集繪制雙標圖
案例3-4 考試成績的主成分分析
代碼3-15 考試成績的主成分分析
代碼3-16 考試成績的主成分分析以及繪制雙標圖
3.4 因子分析
3.4.1 因子分析的基本思路
3.4.2 使用Python進行因子分析
代碼3-17 關於5個科目考試成績的因子分析
代碼3-18 使用雙標圖表示波士頓房價數據的因子分析
3.5 對應分析
代碼3-19 使用mca程序庫進行對應分析
第4章 使用機器學習算法進行多維度變量分析——聚類分析/k-近鄰算法/決策樹/支持向量機
4.1 聚類算法的基本思路
4.2 分層聚類
代碼4-1 使用Scipy庫進行分層聚類
代碼4-2 對費希爾鳶尾花數據集進行分層聚類
4.3 使用k-均值算法進行非分層聚類
代碼4-3 使用k-均值算法對費希爾鳶尾花數據集的花瓣長度和寬度進行聚類分析
4.4 使用EM算法估計高斯混合分布
4.4.1 估計高斯混合分布
4.4.2 使用Python進行高斯混合分布估計
代碼4-4 生成高斯混合分布並進行聚類分析(1)
代碼4-5 生成高斯混合分布並進行聚類分析(2)
4.5 k-近鄰算法
4.5.1 k-近鄰算法的基本思路
4.5.2 使用Python實現k-近鄰算法
代碼4-6 從費希爾鳶尾花數據集中抽取15條作為訓練數據計算k-近鄰算法
4.6 決策樹算法
代碼4-7 將學生考試成績生成決策樹
代碼4-8 基於費希爾鳶尾花數據集生成決策樹
4.7 支持向量機
代碼4-9 使用SVM類對費希爾鳶尾花數據集(花瓣長度和寬度)進行分類
第5章 關聯分析
5.1 關聯分析詳解
5.1.1 關聯規則與分析指標
5.1.2 Apriori算法
5.2 使用Python進行關聯分析
5.2.1 程序庫mlxtend
代碼5-1 使用mlxtend進
