↑: [[G検定に関する知識]] - 専門家(人間)のデモンストレーションデータからエージェントが行動を学習する手法 - [[強化学習]]と組み合わせて使われることが多い(初期性能の底上げ) - [[AlphaStar]]はプロ選手のリプレイで模倣学習 → その後強化学習で超える - 行動クローニング(Behavior Cloning)が最もシンプルな実装 - 逆強化学習(IRL)は報酬関数自体を推定する発展形