適用製品
音声認識タスクを実現するための推論器、推論プログラムおよび学習方法
目的
より少ないパラメータサイズのモデルを用いて、多言語エンド・トゥ・エンド音声認識システムを実現するための技術を提供する。
効果
より少ないパラメータサイズのモデルを用いて、多言語エンド・トゥ・エンド音声認識システムを実現できる。
技術概要
複数の言語のうち任意の言語で発話された音声信号の入力を受けて、対応するテキストを出力する推論器であって、
前記音声信号の音声特徴を示す入力シーケンスを受けて、対応するテキストに含まれる文字の特徴を示す、文字レベルとは異なるレベルの表現を出力する学習済モデルと、
予め定められた文字と当該文字の特徴との対応関係を参照して、前記学習済モデルから出力される表現から対応するテキストを再構成する再構成部とを備える、推論器。