本書以任務為導向,全面地介紹數據分析的流程和Python數據分析庫的應用,詳細講解利用Python解決企業實際問題的方法。全書共9章,第1章介紹了數據分析的基本概念等相關知識;第2~6章介紹了Python數據分析的常用庫及其應用,涵蓋NumPy數值計算、Matplotlib數據可視化、pandas統計分析、使用pandas進行數據預處理、使用scikit-learn構建模型,較為全面地闡述了Python數據分析方法;第7~9章結合之前所學的數據分析技術,進行企業綜合案例數據分析。除第1章外,本書各章都包含了實訓與課后習題,通過練習和操作實踐,幫助讀者鞏固所學的內容。
本書可作為高校大數據技術類專業的教材,也可以作為大數據技術愛好者的自學用書。
張良均,高級信息系統項目管理師,泰迪杯全國大學生數據挖掘競賽(www.tipdm.org)的發起人。華南師范大學、廣東工業大學兼職教授,廣東省工業與應用數學學會理事。兼有大型高科技企業和高校的工作經歷,主要從事大數據挖掘及其應用的策划、研發及咨詢培訓。全國計算機技術與軟件專業技術資格(水平)考試繼續教育和CDA數據分析師培訓講師。發表數據挖掘相關論文數二十余篇,已取得國家發明專利12項,主編圖書《神經網絡實用教程》《數據挖掘:實用案例分析》《Python數據分析與挖掘》等多本暢銷圖書,主持並完成科技項目9項。獲得SAS、SPSS數據挖掘認證及Hadoop開發工程師證書,具有電力、電信、銀行、制造企業、電子商務和電子政務的項目經驗和行業背景。
本書可作為高校大數據技術類專業的教材,也可以作為大數據技術愛好者的自學用書。
張良均,高級信息系統項目管理師,泰迪杯全國大學生數據挖掘競賽(www.tipdm.org)的發起人。華南師范大學、廣東工業大學兼職教授,廣東省工業與應用數學學會理事。兼有大型高科技企業和高校的工作經歷,主要從事大數據挖掘及其應用的策划、研發及咨詢培訓。全國計算機技術與軟件專業技術資格(水平)考試繼續教育和CDA數據分析師培訓講師。發表數據挖掘相關論文數二十余篇,已取得國家發明專利12項,主編圖書《神經網絡實用教程》《數據挖掘:實用案例分析》《Python數據分析與挖掘》等多本暢銷圖書,主持並完成科技項目9項。獲得SAS、SPSS數據挖掘認證及Hadoop開發工程師證書,具有電力、電信、銀行、制造企業、電子商務和電子政務的項目經驗和行業背景。