AI基礎
強化学習とは?
読み: きょうかがくしゅう英語: Reinforcement Learning更新日: 2026-06-23
強化学習とは、エージェントが環境で行動し、得られる報酬を最大化するように学習する方法です。
生成AIパスポートG検定AWS AI Practitioner
関連表記: 強化学習 / Reinforcement Learning / RL / 報酬
試験で問われるポイント
- 教師あり学習の正解ラベルではなく、報酬を手がかりにします。
- ゲームAI、ロボット制御、最適化問題などで使われます。
- 生成AI文脈ではRLHFとの関係も押さえたい用語です。
具体例
ゲームで高得点を取る行動を試行錯誤しながら学ぶAIが例です。
混同しやすい点
- 報酬を正解ラベルと同じ意味で扱う。
- 強化学習は生成AIだけに使われると考える。
関連問題で復習
AWS AI PractitionerAI・機械学習の基礎
強化学習の学習の仕組みを説明するものとして、最も適切なものはどれですか。
G検定機械学習の概要・具体的手法
「強化学習」の説明として、最も適切なものはどれか。
G検定ディープラーニングの応用例
「強化学習」における「報酬」の役割として、最も適切なものはどれか。
G検定ディープラーニングの応用例
深層強化学習の応用例として、最も適切なものはどれか。
AWS AI Practitioner基盤モデルの活用
生成AIモデルの調整手法である「RLHF(人間のフィードバックによる強化学習)」の説明として、最も適切なものはどれですか。
G検定ディープラーニングの応用例
「RLHF(Reinforcement Learning from Human Feedback)」の説明として、最も適切なものはどれか。
AWS AI PractitionerAI・機械学習の基礎
小売企業が過去の購買履歴と「購入した/しなかった」の正解ラベルを使って、次回キャンペーンで購入しそうな顧客を予測するモデルを作りたいと考えています。この学習方法として最も適切なものはどれですか。
AWS AI PractitionerAI・機械学習の基礎
教師あり学習に該当するユースケースとして適切なものを2つ選べ。