↑: [[G検定に関する知識]] - DQNの改良版:ネットワークの重みにノイズを加えることで探索を実現 - ε-greedy法に代わる探索戦略 - cf. [[DQN-G検定]], [[Rainbow]], [[深層強化学習]]