巨量資料時代來臨,
你需要最新、最實用、功能最強的資料分析工具─R語言
你需要最新、最實用、功能最強的資料分析工具─R語言
R是一套自由免費的軟體,具有入門容易、使用簡單之特色,目前多應用於機器學習、資料探勘、文字探勘、統計分析及巨量資料分析等領域。
本書第1至5章先介紹R的基本操作及應用,包括認識R語言特性、資料讀取及寫入方式,接著介紹R的繪圖功能及相關套件之運用;第6至9章介紹各類學習演算法,如:決策樹、K平均算法、基因演算法等,每一章節都加入範例供讀者即時練習;第10至12章介紹關聯性規則、社群網路分析、文字探勘及圖形化資料分析工具等內容,將R軟體在資料分析上的使用作更完整的補充,對於沒有程式設計經驗的讀者來說,本書是入門的最佳選擇;第13章及14章加入巨量資料分析介紹,讀者可先了解Hadoop基本原理並充分結合R與Hadoop之功能;讀者亦可了解Spark基本原理並充分學習SparkR之功能,進而導引讀者進入巨量資料分析的殿堂;第15章加入SparkR應用,讀者可瞭解如何應用SparkR。
本書特色
1. 各章節皆附範例實作,幫助初學者從做中學,增加練習機會,同時培養自行撰寫程式之能力。
2. 附錄加入R、RStudio、Hadoop及Spark軟體的下載及安裝步驟,指令清楚、操作容易,讓讀者輕鬆完成安裝。