講演音声認識のための音響・言語モデルの検討

スポンサーリンク

概要

論文の詳細を見る
融合研究プロジェクトにおいて構築が進められている講演音声と書き起こしテキストのデータベースを用いて、講演音声の認識のための音響・言語モデルを作成した。男性4名による音声・言語関係の学会講演を対象として評価を行った。これらのデータには話し言葉に固有の表現や発声の怠けなどが頻出する。利用できる講演の種類と量が多様であるため、音響・言語モデルそれぞれの学習にどのようなデータの組み合わせが適当であるかの検討を行った。音響モデルの学習には、学会講演というスタイルに一致させることの効果を確認し、言語モデルにおいても同様の傾向を確認した。現時点では平均59.8%の単語認識精度を得ることができた。
社団法人電子情報通信学会の論文
2000-12-15

著者

関連論文

もっと見る

スポンサーリンク