音声認識

おんせいにんしき

意味

音声認識とは、人間が発した音声信号をコンピュータが解析し、対応するテキストデータへと自動的に変換する技術およびプロセスの総称です。この技術の根底には、音声の特徴を数理的に捉える音響モデルや言葉の繋がりやすさを確率で表す言語モデルなどが用いられており、近年では深層学習をはじめとする機械学習技術の進歩によって認識精度が向上しています。かつては事前に登録した特定の単語や制限された話し方にしか対応できませんでしたが、現在では不特定話者の自然な発話や連続した長文の会話であっても高精度でテキスト化することが可能です。私たちの日常生活やビジネスシーンにおいて、情報機器を操作するための音声インターフェースの基盤技術として広く普及しています。

類義語

音声認識技術、音声入力

音声認識の詳しい解説・事例・出典を見る →
最終更新: