講演音声認識のための言語モデルの教師なし適応

スポンサーリンク

概要

論文の詳細を見る
大語彙の話し言葉音声認識における言語モデルの教師なし話者適応について報告をおこなう.講演などの話し言葉においては,話題の他に文末表現などで発話の傾向やその発音が話者間で大きく異なるため,言語・発音モデルの話者性へめ適応が必要である.本稿では,教師なし言語モデル話者適応手法として(1)認識結果を直接用いて適応する手法,及び(2)発話文単位で類似テキストを選択しそれを用いて適応する手法,を提案する.その上で発音変動のモデル化についても検討し,話者適応の枠組みに統合することで,言語表現の傾向と発音変動の両方を同時にモデル化する.実際の講演の音声認識実験において提案手法それぞれの有効性を確認した.提案手法の統合の効果も確認し,単語誤り率を4.4%改善できた.
社団法人電子情報通信学会の論文
2002-12-13

著者

関連論文

もっと見る

スポンサーリンク