G検定(ジェネラリスト検定) ディープラーニングの要素技術 練習問題 第17問: 音声認識で、ある時点の音がどの音素かを判断するには、その後に続く音も手がかりになることがある。このような場合に使われる双方向RNNの説明として、最も適切なものは
この科目 –/24 解いた
初級推定正答率 約 80%
音声認識で、ある時点の音がどの音素かを判断するには、その後に続く音も手がかりになることがある。このような場合に使われる双方向RNNの説明として、最も適切なものはどれか。
解答と解説を先に見る
正解: 2. 前向きと後ろ向きのRNNを組み合わせ、各時刻で前後両方の文脈を使う。
肢2が正解です。教科書 Deep Learning (Goodfellow ら) の第10章は、双方向 RNN を、系列の先頭から時間の順に進む RNN と、末尾から時間を逆にたどる RNN を組み合わせたものとし、各時刻の出力が過去と未来の両方の入力に依存できると説明しています。例として、音素の判断に後の音素が影響する音声認識や手書き文字認識を挙げています。肢1は誤りで、末尾から読む RNN を1つ使うだけでは、その時刻より前の入力を出力に反映できません。肢3は教師強制の説明です。肢4は双方向 RNN の仕組みではありません。後ろ向きの RNN は系列の末尾から計算するので、系列の後ろの部分がそろうまで出力を確定できない点も押さえておきます。
関連キーワード: 双方向RNN・RNN・音声認識・時系列データ
広告
模試 (60問)
8分野を横断して、知識の穴を見つける
オンライン試験とほぼ同じペース(1つあたり約41秒)で、技術分野から法律・倫理まで8分野を混ぜて解きます。JDLAは分野ごとの出題数と合格ラインを公表していないため、配分と70%の目安はぴよパスの設定です。Premium (月480円)Premium (ご利用中)時間制限つきの実力チェック
広告