目的
入力歌声の音響信号から「人間らしい歌声」を合成するための歌声合成パラメータデータを自動推定する歌声合成パラメータデータ推定システムを提供する。
効果
入力歌声の音響信号から「人間らしい歌声」を合成するための歌声合成パラメータデータを高い精度で自動推定することができる。
技術概要
歌声合成パラメータデータ推定システムは、入力歌声音響信号分析部と、音高パラメータ推定部と、音量パラメータ推定部と、歌声合成パラメータデータ作成部とを備えている。 入力歌声音響信号分析部は、入力歌声の音響信号の少なくとも音高及び音量を含む複数種類の特徴量を分析する。 音高パラメータ推定部は、入力歌声の音響信号の少なくとも音高の特徴量と音節境界が指定された歌詞データとに基づいて、音量パラメータを一定のものとして、入力歌声の音響信号の音高の特徴量に合成された歌声の音響信号の音高の特徴量を近づけることができる音高パラメータを推定する。 音量パラメータ推定部は、入力歌声の音響信号の音量の特徴量を合成された歌声の音響信号の音量の特徴量に対して相対値化し、入力歌声の音響信号の相対値化した音量についての特徴量に合成された歌声の音響信号の音量の特徴量を近づけることができる音量パラメータを推定する。 歌声合成パラメータデータ作成部は、推定が完了した音高パラメータ及び音量パラメータに基づいて歌声合成パラメータデータを作成する。