⑤ ディープラーニングの応用例 / 29. 深層強化学習
アルファスターとは
アルファスターとは、DeepMindが開発した「スタークラフト2」用のAIです。非常に広大な状態空間・行動空間を持つリアルタイム戦略ゲームでプロプレイヤーを破る成果を達成しました。
この用語はG検定シラバスの「29. 深層強化学習」に含まれます。 章全体の用語は用語解説⑤(全133語)にまとまっています。
一言でいうと
DeepMindが開発し、スタークラフト2でプロを破った強化学習AIです。
組み合わせた3つの学習
- 模倣学習:人間のプレイ記録から基本的な戦い方を学ぶ
- 自己対戦型強化学習:AI同士を戦わせて強くしていく
- マルチエージェント学習:多様な戦略を持つ相手を用意して偏りを防ぐ
いきなり強化学習だけで始めると探索空間が広すぎて学習が進みません。まず人間から学ぶという順序が有効でした。
OpenAI Fiveとの対比
| AI | ゲーム | 開発 |
|---|---|---|
| アルファスター | スタークラフト2 | DeepMind |
| OpenAI Five | Dota 2 | OpenAI |
ゲーム名と開発元の組み合わせが入れ替えて覚えてしまいやすいので注意してください。
制約を設ける公平性
対戦にあたっては、操作速度や視野に人間と同等の制限が設けられました。
機械の反応速度で勝っても意味がないためです。何をもって「勝った」とするかという評価設計の難しさが表れています。
🎯 G検定での押さえどころ
- DeepMindが開発、スタークラフト2用
- 模倣学習+自己対戦+マルチエージェント
- OpenAI Five(Dota 2・OpenAI)との対比
⚠️ よくある誤りの選択肢
- 「アルファスターはOpenAIが開発したDota 2用のAIである」→ 誤り。DeepMindのスタークラフト2用です
📘 もっと深く学ぶ
- 数式レベルまで踏み込んだ解説 → 医療AIナビ「深層強化学習の概要」(E資格向け)
関連する用語
ご利用にあたって 本ページの内容は、JDLAが公開しているG検定シラバス2024や公式テキストなど、一般に公開されている情報をもとに独自に整理・解説したものです。実際の試験の出題内容を示すものではなく、また合格を保証するものでもありません。制度・法令・試験要項は変更されることがあるため、最新の情報は必ずJDLA公式サイトでご確認ください。