音声認識装置及び音声認識プログラム

開放特許情報番号:L2012001523 開放特許情報登録日:2012/5/11 最新更新日:2012/5/11

基本情報
出願番号
公開番号
登録番号
出願日
2008/8/27
公開日
2010/3/11
出願人
日本放送協会
特許権者
日本放送協会
権利化状況
権利化済
発明の名称
音声認識装置及び音声認識プログラム
開放特許情報
技術分野
情報・通信
機能
制御・ソフトウェア 機械・部品の製造
適用製品
音声認識装置及び音声認識プログラムに係り、特に連続的に更新させた最新モデルを用いて高精度な音声認識を実現するための音声認識装置及び音声認識プログラム
目的
連続的に更新させた最新モデルを用いて高精度な音声認識を実現する。
効果
音声認識を途切れさせることなく、音声認識を行う音声認識デコーダを最新モデルのものに切り替えることにより、常に最新モデルを用いて高精度な音声認識を連続して実現するものである。例えば、テレビの生放送番組にリアルタイムで字幕を付与する目的で音声認識を利用する場合、放送中に既に音声認識を運用している状態であっても、音声認識を一瞬たりとも停止させることなく、常に最新モデルを読み込み、高精度な音声認識を連続して実現することができる。
技術概要
入力音声を認識して文字に変換する音声認識装置において、言語モデル、発音辞書、音響モデル、及び音声認識パラメータのうち少なくとも1つを随時学習するモデル学習手段と、前記モデル学習手段により最新モデルに更新されたことを通知するモデル更新通知手段と、前記入力音声の音響特徴量を抽出する音響分析手段と、前記音響分析手段により得られる音響特徴量と、予め蓄積或いは前記モデル学習手段により更新された言語モデル、発音辞書、音響モデル、及び音声認識パラメータを読み込み、前記音響特徴量の音声認識を行う複数の音声認識デコーダと、前記複数の音声認識デコーダのうち、前記モデル更新通知手段により通知される更新情報に基づいて、前記音声認識を行う音声認識デコーダの選択を行うデコーダ制御手段とを有することにより、上記課題を解決する。
イメージ図
実施実績   :
許諾実績 :
特許権譲渡  :
特許権実施許諾:
登録者情報
その他の情報
関連特許
(国内):
(国外):
固定URLをクリップボードにコピーしました。
Copyright © INPIT Rights Reserved