↑: [[G検定に関する知識]] - 未来の報酬を割り引くための係数γ(0〜1) - 先の報酬ほどγを掛けた分だけ小さく評価する(未来は不確実なため) - γが小さいと目先重視、大きいと長期視点になる - 実用では0.9〜0.99あたりがよく使われる - cf. [[強化学習]] [[マルコフ決定過程-G検定]]