適用製品
言語モデル処理装置、およびその言語モデルを用いる音声認識装置、ならびにそのプログラム
目的
学習により統計的言語モデルを構築するためのコストを削減することのできる言語モデル処理装置を提供する。
さらに、利用者がターゲットとするタスクに適合した学習により統計的言語モデルを構築する言語モデル処理装置を提供する。
効果
言語モデルを用いた場合の音声認識精度を向上させることができる。
特定のタスクにおいて特に音声認識精度を向上させることができ、さらに、予め正解データを用意する必要がなく、低コスト化が可能となる。
また、本発明は、音声認識処理一般に広く利用できる。例えば、音声認識処理によって自動的に書き起こしテキストを生成する目的で、本発明を利用できる。また、番組情報を、自動的に取得する目的で、本発明を利用できる。
技術概要
正解なし認識結果記憶部は、正解のない音声認識結果データを記憶する。言語モデル記憶部は、言語表現の出現確率を表すデータである言語モデルを記憶する。正解なし誤り傾向学習部は、入力される所定の言語モデルと、正解のない音声認識結果データとに基づいて、音声認識の誤り傾向の学習処理を行い、この誤り傾向の学習結果によって言語モデルを更新して、更新された言語モデルを言語モデル記憶部に書き込む。