購物比價找書網找車網
FindBook
排序:
 
 有 1 項符合

邱偉育

的圖書
圖書介紹 - 資料來源:TAAZE 讀冊生活   評分:
圖書名稱:強化學習導論 

1.本書從假設與理論開始討論,再進入演算法與範例,讓讀者了解整體架構的來龍去脈。
2.每章的開始先綜述該章的主要內容,讓讀者有大方向的了解,再進入細節的討論。
3.相關概念以圖示方式呈現,讀者較易理解與統整。
4.每章搭配範例與程式碼,徹底了解演算法特性。
5.每章結尾作重點回顧,條列該章裡重要概念,方便讀者確認學習重點。
6.本書適用於自學、大學或科大課程教科書與實作專題的輔助教材,以及業界工程師快速奠定強化學習基礎概念與實作能力的教學書籍。
 

近年來因人工智慧興起,帶起許多學生、工程師與學者開始投入相關技術的學習、研究和開發。早期談到人工智慧,大部分會聯想到機器學習中的監督式學習和非監督式學習。然而監督或非監督式學習較難處理動態系統,機器學習技術的另一個分支─強化學習,剛好補足此缺口。強化學習的應用相當廣,最有名的兩個例子為AlphaGo透過資料學習在圍棋比賽上屢獲佳績,以及Google利用強化學習技術,優化資料中心的運作,進而減少40%的冷卻花費。本書以奠定基本功為目的,一步步帶領讀者建構完整的強化學習知識,介紹的相關概念包含:動態規劃、蒙地卡羅法、1步時間差分法、n步時間差分法、近似解法、規劃與學習、資格跡與學習、策略梯度法。
 

目錄
第1章 強化學習框架
1-1 強化學習主要元素與馬可夫決策過程
1-2 範例1.1
1-3 策略和價值函數
1-4 範例1.2
1-5 最佳策略和最佳價值函數
重點回顧
章末練習

第2章 動態規劃
2-1 策略評估
2-2 策略改進
2-3 範例2.1與程式碼
2-4 策略疊代和價值疊代
2-5 動態規劃的優缺點與異步更新
2-6 範例2.2與程式碼
2-7 廣義策略疊代
重點回顧
章末練習

第3章 蒙地卡羅法
3-1 蒙地卡羅預測
3-2 同策略與異策略法
3-3 同策略蒙地卡羅控制
3-4 範例3.1與程式碼
3-5 異策略與重要性抽樣
3-6 異策略蒙地卡羅預測
3-7 異策略蒙地卡羅控制
重點回顧
章末...
顯示全部內容
贊助商廣告
 
金石堂 - 今日66折
宮諜(一)
作者:瀟湘冬兒
出版社:東佑文化事業有限公司
出版日期:2013-02-06
66折: $ 165 
金石堂 - 今日66折
青瞳‧首部曲‧大出天下(下)
作者:媚媚貓
出版社:東佑文化事業有限公司
出版日期:2016-02-17
66折: $ 165 
金石堂 - 今日66折
男人的賞味期——都市懸疑 × 同志感性短篇小說集(雙書封隨機出貨)
作者:賴特
出版社:幻華創造有限公司
出版日期:2025-11-07
66折: $ 141 
金石堂 - 今日66折
貴嫁(六)(完)
作者:夜纖雪
出版社:東佑文化事業有限公司
出版日期:2023-11-22
66折: $ 178 
 
金石堂 - 暢銷排行榜
我的五顆星-全
作者:藤峰式
出版社:長鴻出版社股份有限公司
出版日期:2026-05-15
$ 110 
金石堂 - 暢銷排行榜
上伊那牡丹,醉姿如百合 (首刷附錄版) 02
作者:塀
出版社:東立出版社
出版日期:2026-05-15
$ 135 
Taaze 讀冊生活 - 暢銷排行榜
臺灣漫遊錄
作者:楊双子
出版社:春山出版有限公司
出版日期:2020-04-01
$ 300 
金石堂 - 暢銷排行榜
轉生公主與天才千金的魔法革命(07)
作者:南高春告
出版社:青文出版社股份有限公司
出版日期:2026-05-13
$ 110 
 
金石堂 - 新書排行榜
BLUE LOCK 藍色監獄 (首刷限定版) 36
作者:金城宗幸/ノ村優介
出版社:東立出版社
出版日期:2026-05-11
$ 126 
Taaze 讀冊生活 - 新書排行榜
只要愛上這份戀情就好(全)
作者:へいゆくえ
出版社:長鴻出版社(漫畫)
出版日期:2026-05-13
$ 105 
Taaze 讀冊生活 - 新書排行榜
冷面天使 典藏版(02)
作者:八木教広
出版社:長鴻出版社(漫畫)
出版日期:2026-05-13
$ 240 
金石堂 - 新書排行榜
精準防癌:不讓細胞作惡,精準預防癌變之路
作者:張家銘
出版社:寶瓶文化事業有限公司
出版日期:2026-04-22
$ 355 
 

©2026 FindBook.com.tw -  購物比價  找書網  找車網  服務條款  隱私權政策