Introduction to Online Control

個数:
  • 予約

Introduction to Online Control

  • 現在予約受付中です。出版後の入荷・発送となります。
    重要:表示されている発売日は予定となり、発売が延期、中止、生産限定品で商品確保ができないなどの理由により、ご注文をお取消しさせていただく場合がございます。予めご了承ください。

    ●3Dセキュア導入とクレジットカードによるお支払いについて
  • 【入荷遅延について】
    世界情勢の影響により、海外からお取り寄せとなる洋書・洋古書の入荷が、表示している標準的な納期よりも遅延する場合がございます。
    おそれいりますが、あらかじめご了承くださいますようお願い申し上げます。
  • ◆画像の表紙や帯等は実物とは異なる場合があります。
  • ◆ウェブストアでの洋書販売価格は、弊社店舗等での販売価格とは異なります。
    また、洋書販売価格は、ご注文確定時点での日本円価格となります。
    ご注文確定後に、同じ洋書の販売価格が変動しても、それは反映されません。
  • 製本 Hardcover:ハードカバー版/ページ数 171 p.
  • 言語 ENG
  • 商品コード 9781009499668

Full Description

This tutorial guide introduces online nonstochastic control, an emerging paradigm in control of dynamical systems and differentiable reinforcement learning that applies techniques from online convex optimization and convex relaxations to obtain new methods with provable guarantees for classical settings in optimal and robust control. In optimal control, robust control, and other control methodologies that assume stochastic noise, the goal is to perform comparably to an offline optimal strategy. In online control, both cost functions and perturbations from the assumed dynamical model are chosen by an adversary. Thus, the optimal policy is not defined a priori and the goal is to attain low regret against the best policy in hindsight from a benchmark class of policies. The resulting methods are based on iterative mathematical optimization algorithms and are accompanied by finite-time regret and computational complexity guarantees. This book is ideal for graduate students and researchers interested in bridging classical control theory and modern machine learning.

Contents

Symbols; Part I. Background in Control and RL: 1. Introduction; 2. Dynamical systems; 3. Markov decision processes; 4. Linear dynamical systems; 5. Optimal control of linear dynamical systems; Part II. Basics of Online Control: 6. Regret in control; 7. Online nonstochastic control; 8. Online nonstochastic system identification; Part III. Learning and Filtering: 9. Learning in unknown linear dynamical systems; 10. Kalman filtering; 11. Spectral filtering; Part IV. Online Control with Partial Observation: 12. Policy classes for partially observed systems; 13. Online nonstochastic control with partial observation; References; Index.

最近チェックした商品