適用製品
音声認識システム、音声認識方法およびプログラム
目的
大規模言語モデルを利用して、より推論精度の高い音声認識システムを提供する。
効果
大規模言語モデルを利用して、より推論精度の高い音声認識システムを提供できる。
技術概要
音声信号に含まれる単語に対応するトークンをトークン単位で出力することのできる第1の学習済み推論モデルと、
1または複数のトークンの入力に基づく推論によって、対応する1または複数のトークンを出力する第2の学習済み推論モデルと、
前記第1の学習済み推論モデルの第1推論出力と、前記第2の学習済み推論モデルの出力であって、前記第1推論出力に対応する第2推論出力とを単語単位で乗算する乗算器とを備え、
前記乗算器の出力である新たな確率分布に基づき選択した単語が、前記第2の学習済み推論モデルに入力される、音声認識システム。