令和6年度 問78
基礎理論
音声認識に該当する処理
利用者がスマートスピーカーに向けて話し掛けた内容に対して,スマートスピーカーから音声で応答するための処理手順が(1)〜(4)のとおりであるとき,音声認識に該当する処理はどれか。
- (1)利用者の音声をテキストデータに変換する。
- (2)テキストデータを解析して,その意味を理解する。
- (3)応答する内容を決定して,テキストデータを生成する。
- (4)生成したテキストデータを読み上げる。
- ア(1)
- イ(2)
- ウ(3)
- エ(4)
答えと解説を見る
✓ これが正解ア(1)
解説
声を文字に変えるところまでが、音声認識の受け持ちです。
話しかけてから応答が返るまでには、性質の違う四つの処理が並んでいます。音声認識が受け持つのは、入ってきた声を文字のデータに変えるところまでです。よって最初の処理が当てはまります。文字になった後、その意味を読み取るのは言葉を扱う別の処理で、何を返すかを決めるのはさらに別の判断です。最後に文字を声にして読み上げる処理は、音を扱う点では似ていますが向きが逆になります。認識は音から文字へ、読み上げは文字から音へです。四つのうち二つが音に関わるので、どちらの向きかを確かめることが要点になります。入口が認識、出口が読み上げ、と押さえておけば迷いません。
ほかの選択肢はなぜ違うのか
- イ(2):文字になったデータを解析して意味を読み取る処理です。扱っているのはすでに文字になったもので、声を文字に変える処理はその前に終わっています。言葉の意味を扱う段にあたります。
- ウ(3):何を返すかを決めて文字のデータを組み立てる処理です。入力ではなく出力を作る側であり、聞き取ることとは向きが逆になります。判断を担う段です。何を言うかを決めるところで、聞き取りはとうに終わっています。
- エ(4):組み立てた文字を読み上げる処理です。音を扱う点では最初の処理と似ていますが、文字から音へという逆向きの変換です。音が出てくるほうを認識と呼ぶことはありません。
出典:令和6年度 ITパスポート試験 問78(改変:原典の図表をテキストに書き起こした)
この解説に誤りを見つけたら教えてください。直して、直した記録を残します。誤りを報告する(メールが開きます)