深層強化学習<br>Deep Reinforcement Learning : Frontiers of Artificial Intelligence

個数:

深層強化学習
Deep Reinforcement Learning : Frontiers of Artificial Intelligence

  • 在庫がございません。海外の書籍取次会社を通じて出版社等からお取り寄せいたします。
    通常6~9週間ほどで発送の見込みですが、商品によってはさらに時間がかかることもございます。
    重要ご説明事項
    1. 納期遅延や、ご入手不能となる場合がございます。
    2. 複数冊ご注文の場合は、ご注文数量が揃ってからまとめて発送いたします。
    3. 美品のご指定は承りかねます。

    ●3Dセキュア導入とクレジットカードによるお支払いについて
  • 【入荷遅延について】
    世界情勢の影響により、海外からお取り寄せとなる洋書・洋古書の入荷が、表示している標準的な納期よりも遅延する場合がございます。
    おそれいりますが、あらかじめご了承くださいますようお願い申し上げます。
  • ◆画像の表紙や帯等は実物とは異なる場合があります。
  • ◆ウェブストアでの洋書販売価格は、弊社店舗等での販売価格とは異なります。
    また、洋書販売価格は、ご注文確定時点での日本円価格となります。
    ご注文確定後に、同じ洋書の販売価格が変動しても、それは反映されません。
  • 製本 Paperback:紙装版/ペーパーバック版/ページ数 203 p.
  • 言語 ENG
  • 商品コード 9789811382871
  • DDC分類 005

Full Description

This book starts by presenting the basics of reinforcement learning using highly intuitive and easy-to-understand examples and applications, and then introduces the cutting-edge research advances that make reinforcement learning capable of out-performing most state-of-art systems, and even humans in a number of applications. The book not only equips readers with an understanding of multiple advanced and innovative algorithms, but also prepares them to implement systems such as those created by Google Deep Mind in actual code.

This book is intended for readers who want to both understand and apply advanced concepts in a field that combines the best of two worlds - deep learning and reinforcement learning - to tap the potential of 'advanced artificial intelligence' for creating real-world applications and game-winning algorithms.

Contents

Introduction to Reinforcement Learning.- Mathematical and Algorithmic understanding of Reinforcement Learning.- Coding the Environment and MDP Solution.- Temporal Difference Learning, SARSA, and Q Learning.- Q Learning in Code.- Introduction to Deep Learning.- Implementation Resources.- Deep Q Network (DQN), Double DQN and Dueling DQN.- Double DQN in Code.- Policy-Based Reinforcement Learning Approaches.- Actor-Critic Models & the A3C.- A3C in Code.- Deterministic Policy Gradient and the DDPG.- DDPG in Code.

最近チェックした商品