適用製品
音声認識および音声合成が可能な推論器、ならびに、その学習方法
目的
ASRとTTSとを統合可能な新たなフレームワークを提供する。
効果
ASRとTTSとを統合可能な新たなフレームワークを提供できる。
技術概要
音声信号の入力に対して、当該音声信号に含まれる音要素を示す状態シーケンスを出力する学習済の音響モデルと、
入力された音声信号を変換して出力する学習済の音声変換モデルとを備え、
前記音響モデルは、音声信号と対応する状態シーケンスとの組を第1の教師データとして用いて学習されたものであり、
前記音声変換モデルは、前記音響モデルから目的の状態シーケンスが出力されるように、前記音響モデルに入力する音声信号を繰り返し更新することで決定された敵対的音声と、当該目的の状態シーケンスに対応する音声信号との組を第2の教師データとして用いて学習されたものである、推論器。