. Deep Learning 4|用Python進行強化學習的開發實作
                                                                      
 
 
 
 

Deep Learning 4|用Python進行強化學習的開發實作 
作者: 斎藤康毅
譯者: 吳嘉芳
書號: A720     出版日: 2023/09/12
ISBN: 9786263246119     EAN: 9786263246119
紙本書價格: 680     附件:  線上下載
電子書: 尚未出版
  博客來  
  金石堂  
  天瓏  
  MOMO  
  團體購書



回頁首
本暢銷系列作品的第4本書,這次的主題是強化學習。書中延續此系列的一貫風格,顯示實際的程式碼,讓讀者邊執行邊學習,不依賴外部程式庫,從零開始建置、學習支撐強化學習的基本技術與概念。

從「理論」與「實踐」兩方面著手,仔細解說強化學習這個複雜主題的構成要素,讓讀者確實掌握強化學習的獨特理論。有別於只用公式說明理論的書籍,讀者可以從書中的程式碼,獲得許多意想不到的領悟。

回頁首
斎藤康毅
1984年生於長崎縣對馬,畢業於東京工業大學工學院,東京大學研究所學際情報學府學士課程修畢。現在於企業內從事與電腦視覺、機器學習有關的研究開發工作。1984年生於長崎縣對馬,畢業於東京工業大學工學院,東京大學研究所學際情報學府學士課程修畢。現在於企業內從事與電腦視覺、機器學習有關的研究開發工作。


回頁首

第 1 章 吃角子老虎機問題
第 2 章 馬可夫決策過程
第 3 章 貝爾曼方程式
第 4 章 動態規劃法
第 5 章 蒙地卡羅法
第 6 章 TD 法
第 7 章 類神經網路與 Q 學習
第 8 章 DQN
第 9 章 策略梯度法
第 10 章 進階內容
附錄 A 離線策略蒙地卡羅法
附錄 B n 步 TD 法
附錄 C 理解 Double DQN
附錄 D 驗證策略梯度法

回頁首

金融風險管理的機器學習應用|使用Python 機器學習模擬應用|將合成資料運用於AI 建構機器學習管道|運用TensorFlow實現模型生命週期自動化

回頁首

請選擇所需之附件
範例檔
檔案名稱
下載
檔案名稱
下載
範例檔


 


  
 

關於碁峰隱私權政策聯絡我們     檢視 : PC 版  手機版
碁峰資訊股份有限公司 GOTOP INFORMATION INC.
台北市南港區三重路66號7樓之6 / 7F.-6,No.66,Sanchong Rd.,Nangang District,Taipei
TEL:(02)2788-2408 FAX:(02)8192-4433 劃撥帳號:14244383
Copyright 2014© GOTOP Information Inc, All Rights Reserved 請勿任意連結、轉載