生成AIの安全性入門

個数:

生成AIの安全性入門

  • ウェブストアに5冊在庫がございます。(2026年09月12日 04時19分現在)
    通常、ご注文翌日~2日後に出荷されます。
  • 出荷予定日とご注意事項
    ※上記を必ずご確認ください

    【ご注意事項】 ※必ずお読みください
    ◆在庫数は刻々と変動しており、ご注文手続き中に減ることもございます。
    ◆在庫数以上の数量をご注文の場合には、超過した分はお取り寄せとなり日数がかかります。入手できないこともございます。
    ◆事情により出荷が遅れる場合がございます。
    ◆お届け日のご指定は承っておりません。
    ◆「帯」はお付けできない場合がございます。
    ◆画像の表紙や帯等は実物とは異なる場合があります。
    ◆特に表記のない限り特典はありません。
    ◆別冊解答などの付属品はお付けできない場合がございます。
  • ●3Dセキュア導入とクレジットカードによるお支払いについて
    ●店舗受取サービス(送料無料)もご利用いただけます。
    ご注文ステップ「お届け先情報設定」にてお受け取り店をご指定ください。尚、受取店舗限定の特典はお付けできません。詳細はこちら
  • サイズ A5判/ページ数 240p/高さ 21cm
  • 商品コード 9784297157029
  • NDC分類 007.1
  • Cコード C3055

出版社内容情報

生成AIの進展は社会や産業に大きな変革をもたらす一方、生成AIが生み出す有害なコンテンツや意図しない挙動といったリスクに関する課題が浮き彫りになっています。本書は、エンジニア、研究者を対象に、生成AIにおけるリスクとその対処法を体系的にまとめます。1章ではAI安全性を定義し、近年の動向を概説します。2章では現実に直面する脅威を分類・整理します。3章でOpenAIが公開しているモデルスペックを題材にAIの理想的な振る舞いについて考えます。第4章で安全性に関する評価方法について紹介したあと、5章ではレッドチーミングについて解説します。6章と7章でモデルレベル、システムレベル双方からの安全性向上技術を解説し、最終章でAI安全性の未来について考察します。安全な生成AIの開発と運用に必要となる知識を1冊にまとめます。


【目次】

第1章 AI安全性の基礎
1.1 AI安全性とは
1.2 AI安全性の社会的動向
1.3 まとめ
第2章 AIリスクの分類
2.1 不快表現を生成するリスク
2.2 情報漏洩リスク
2.3 誤情報リスク
2.4 悪用リスク
2.5 精神的依存リスク
2.6 その他の外部に潜むリスク
2.7 まとめ
第3章 AIの理想的な振る舞い
3.1 モデルスペックの構成
3.2 安全性ルール:制約の範囲を超えない
3.3 他組織のルール
3.4 まとめ
第4章 安全性評価技術:ベンチマーク
4.1 LLMを評価する安全性ベンチマーク
4.2 MLLMを評価する安全性ベンチマーク
4.3 まとめ
第5章 安全性評価技術:レッドチーミング
5.1 レッドチーミングの概要
5.2 攻撃手法の体系化
5.3 レッドチーミング実践
5.4 まとめ
第6章 安全性向上技術:モデルレベル
6.1 事前学習における安全性向上技術
6.2 SFTにおける安全性向上技術
6.3 RLHFにおける安全性向上技術
6.4 合成データアプローチ
6.5 推論フェーズにおける安全性制御
6.6 まとめ
第7章 安全性向上技術:システムレベル
7.1 ガードレール
7.2 ガードレールコンポーネント
7.3 ガードレールツールキット
7.4 まとめ
第8章 AI安全性の未来
8.1 対話から実行へ:エージェントAIのリスク
8.2 デジタルから物理世界へ:ロボティクスAIのリスク
8.3 人知を超えた知性へ:AGI/ASIのリスク
8.4 まとめ
付録A 実務クイックスタート

内容説明

安全なAIを実現するための終わりなき挑戦。AIリスク AIガバナンス 責任あるAI モデルスペック 憲法AI 安全性チューニング 安全性評価ベンチマーク レッドチーミング AIセキュリティ ガードレール ジェイルブレイク 過剰安全性。

目次

第1章 AI安全性の基礎
第2章 AIリスクの分類
第3章 AIの理想的な振る舞い
第4章 安全性評価技術:ベンチマーク
第5章 安全性評価技術:レッドチーミング
第6章 安全性向上技術:モデルレベル
第7章 安全性向上技術:システムレベル
第8章 AI安全性の未来

著者等紹介

綿岡晃輝[ワタオカコウキ]
2021年、神戸大学大学院システム情報学研究科博士前期課程修了。同年、LINE株式会社(現・LINEヤフー株式会社)に入社し、Trustworthy AIチームに配属。LLM(大規模言語モデル)の信頼性および安全性に関する研究開発に従事。2024年よりSB Intuitions株式会社に入社し、Responsible AIチームのリーダーとして、大規模言語モデルやVLM(視覚言語モデル)における安全性向上に関する研究開発に携わっている。総務省AIセキュリティ分科会構成員(本データはこの書籍が刊行された当時に掲載されていたものです)
※書籍に掲載されている著者及び編者、訳者、監修者、イラストレーターなどの紹介情報です。

感想・レビュー

※以下の感想・レビューは、株式会社ドワンゴの提供する「読書メーター」によるものです。

そけ

0
LLM Safetyに関連する知識を網羅的に紹介している本。 個人的には著者の色がもう少し感じられると嬉しかったです(重要なテーマを深く掘り下げる、著者自身の主張がある、など)。2026/08/05

外部のウェブサイトに移動します

よろしければ下記URLをクリックしてください。

https://bookmeter.com/books/23382826
  • ご注意事項

    ご注意
    リンク先のウェブサイトは、株式会社ドワンゴの提供する「読書メーター」のページで、紀伊國屋書店のウェブサイトではなく、紀伊國屋書店の管理下にはないものです。
    この告知で掲載しているウェブサイトのアドレスについては、当ページ作成時点のものです。ウェブサイトのアドレスについては廃止や変更されることがあります。
    最新のアドレスについては、お客様ご自身でご確認ください。
    リンク先のウェブサイトについては、「株式会社ドワンゴ」にご確認ください。

最近チェックした商品