↑: [[G検定に関する知識]] - OpenAI開発のDota 2(5対5チーム戦ゲーム)プレイAI - 世界チャンピオンチームに勝利 - 使用技術 - PPO(Proximal Policy Optimization)の大規模並列学習 - [[LSTM]](長期記憶)で時系列情報を処理 - 5体のAIがチームとして連携するマルチエージェント強化学習 - cf. [[AlphaStar]]、[[Agent57]]