↑: [[G検定に関する知識]] - 音声波形からテキストを生成するタスク(ASR: Automatic Speech Recognition) - 用途例:Siri、Alexa、音声入力 - 古典手法:MFCC+HMM - DL手法:CTC、Attention Encoder-Decoder、Whisper(OpenAI) - cf. [[MFCC]], [[CTC]], [[隠れマルコフモデル]], [[音声処理]]