音声処理

おんせいしょり

意味

音声処理とは、人間の発する音声をデジタル信号に変換し、コンピュータを用いて分析、加工、認識、合成する一連の技術およびその学問領域のことです。具体的には、音声から意味を解釈する音声認識技術、テキストデータから自然な人間の声を生成する音声合成技術、個人の声紋を識別する話者認識技術などが含まれます。古くは信号処理の数学的理論を基礎として発展してきましたが、近年では機械学習の目覚ましい進展により、認識精度や音声の自然さが飛躍的に向上しました。これにより、スマートスピーカーや自動翻訳システム、コールセンターの自動応対など、私たちの日常生活や産業のあらゆる場面で不可欠な基盤技術として広く普及しています。

類義語

音声認識、音声合成

音声処理の詳しい解説・事例・出典を見る →
最終更新: