購物比價找書網找車網
FindBook
排序:
 
 有 1 項符合

邱偉育

的圖書
圖書介紹 - 資料來源:TAAZE 讀冊生活   評分:
圖書名稱:強化學習導論 

1.本書從假設與理論開始討論,再進入演算法與範例,讓讀者了解整體架構的來龍去脈。
2.每章的開始先綜述該章的主要內容,讓讀者有大方向的了解,再進入細節的討論。
3.相關概念以圖示方式呈現,讀者較易理解與統整。
4.每章搭配範例與程式碼,徹底了解演算法特性。
5.每章結尾作重點回顧,條列該章裡重要概念,方便讀者確認學習重點。
6.本書適用於自學、大學或科大課程教科書與實作專題的輔助教材,以及業界工程師快速奠定強化學習基礎概念與實作能力的教學書籍。
 

近年來因人工智慧興起,帶起許多學生、工程師與學者開始投入相關技術的學習、研究和開發。早期談到人工智慧,大部分會聯想到機器學習中的監督式學習和非監督式學習。然而監督或非監督式學習較難處理動態系統,機器學習技術的另一個分支─強化學習,剛好補足此缺口。強化學習的應用相當廣,最有名的兩個例子為AlphaGo透過資料學習在圍棋比賽上屢獲佳績,以及Google利用強化學習技術,優化資料中心的運作,進而減少40%的冷卻花費。本書以奠定基本功為目的,一步步帶領讀者建構完整的強化學習知識,介紹的相關概念包含:動態規劃、蒙地卡羅法、1步時間差分法、n步時間差分法、近似解法、規劃與學習、資格跡與學習、策略梯度法。
 

目錄
第1章 強化學習框架
1-1 強化學習主要元素與馬可夫決策過程
1-2 範例1.1
1-3 策略和價值函數
1-4 範例1.2
1-5 最佳策略和最佳價值函數
重點回顧
章末練習

第2章 動態規劃
2-1 策略評估
2-2 策略改進
2-3 範例2.1與程式碼
2-4 策略疊代和價值疊代
2-5 動態規劃的優缺點與異步更新
2-6 範例2.2與程式碼
2-7 廣義策略疊代
重點回顧
章末練習

第3章 蒙地卡羅法
3-1 蒙地卡羅預測
3-2 同策略與異策略法
3-3 同策略蒙地卡羅控制
3-4 範例3.1與程式碼
3-5 異策略與重要性抽樣
3-6 異策略蒙地卡羅預測
3-7 異策略蒙地卡羅控制
重點回顧
章末...
顯示全部內容
贊助商廣告
 
 
博客來 - 暢銷排行榜
有時幸,有時傷(首刷限定「閱讀逗點卡」)
出版日期:2024-12-27
$ 331 
Taaze 讀冊生活 - 暢銷排行榜
臺灣漫遊錄
作者:楊双子
出版社:春山出版有限公司
出版日期:2020-04-01
$ 300 
Taaze 讀冊生活 - 暢銷排行榜
白話厚黑學大全集
作者:李宗吾
出版社:普天
出版日期:2018-08-07
$ 285 
博客來 - 暢銷排行榜
灶形記:台灣經典廚具指南【博客來獨家】
作者:中華民國廚具櫥櫃商業同業公會全國聯合會
出版社:墨刻
出版日期:2024-11-28
$ 355 
 
博客來 - 新書排行榜
失控的焦慮世代:手機餵養的世代,如何面對心理疾病的瘟疫
作者:強納森.海德特 (Jonathan Haidt)
出版社:網路與書出版
出版日期:2024-11-29
$ 379 
博客來 - 新書排行榜
膽大黨 15
作者:龍幸伸
出版社:東立
出版日期:2024-11-22
$ 93 
Taaze 讀冊生活 - 新書排行榜
【告別娑婆系列套書】(二冊):《告別娑婆3》、《告別娑婆外傳》
作者:葛瑞.雷納
出版社:橡實文化
出版日期:2024-12-11
$ 651 
Taaze 讀冊生活 - 新書排行榜
32歲,一家四口用100萬環遊世界:沒規畫x預算少x破英文也OK!從風土人情到實用技巧,開啟親子冒險全新篇章
作者:李婷萱
出版社:墨刻
出版日期:2024-12-14
$ 322 
 

©2024 FindBook.com.tw -  購物比價  找書網  找車網  服務條款  隱私權政策