目的
発話が短くても高い精度で発話言語を認識できるような発話言語認識モデルの訓練方法を提供する。
技術概要
第1の発話時間の発話データで訓練済の第1のニューラルネットワーク(NN)を準備するステップと、第1の発話時間の発話データと、その発話データに含まれる第2の発話時間の発話データと、言語情報とからなる訓練データを含む訓練データを準備するステップと、第1の発話時間の発話データが第1のNNに入力されたときの、第1のNN内の知識の転送元層の出力と、この発話データと関連付けられた第2の発話時間の発話データが第2のNNに入力されたときの第2のNN内の転送先層の出力と、当該第2の発話時間の発話データの言語情報とを少なくとも用いて、前記第2のNNの訓練を行うステップとを含む。