目的
コストを低減しながら、音声合成用のモデルを学習するためのデータを生成することができる学習装置、データ生成装置及びプログラムを提供する。
効果
コストを低減しながら、音声合成用のモデルを学習するためのデータを生成することが可能となる。
技術概要
発話の音声データ又は前記音声データから得られた特徴量を入力し、前記発話における音素を表す文字及びアクセントを表す韻律記号を用いて記述されたテキストのラベルデータを出力するラベリングモデルを、学習用の音声データと正解のラベルデータとの対を用いて学習する学習部、
を備え、
前記学習部は、前記ラベリングモデルを用いて推定されたラベルデータを入力し、入力された前記ラベルデータに含まれる音素の誤りを修正したラベルデータを出力するラベルデータ修正モデルを、誤りが含まれる学習用のラベルデータと正解のラベルデータとの対を用いて学習する、
ことを特徴とする学習装置。