統計モデルに基づく音声合成における話者・スタイルの多様化(オーガナイズドセッション「多様な音声・歌声の合成に向けて」,音声・言語・対話,一般)
スポンサーリンク
概要
- 論文の詳細を見る
本稿では、隠れマルコフモデル(HMM)に基づく音声合成において、話者や感情表現・発話様式(スタイル)を多様化する手法について紹介する。HMM音声合成ではスペクトルや韻律特徴量がモデル内の各状態の分布パラメータとして表現されるため、モデルパラメータの操作、モデルの拡張が容易であり、様々な多様化手法が提案されている。本稿では代表的な話者の多様化手法として話者適応、話者補間、話者強調について、またスタイルの多様化手法としてスタイルモデリングスタイル適応、スタイル補間、スタイル制御、スタイル変換について説明する。さらに声質制御や話し言葉音声についても概説し、今後の課題や展望について述べる。
- 2013-01-23
著者
関連論文
- 重回帰HMMに基づく自然発話音声の発話様式識別(発音評価,認識,理解,対話,一般)
- 重回帰HMMに基づくスタイル推定を用いた音声認識における音響モデル学習法(音声認識・音響モデル,第10回音声言語シンポジウム)
- 平均声からの話者適応手法を用いた重回帰HSMMに基づく合成音声の声質制御(合成,生成,韻律,一般)
- 重回帰HSMMを用いた合成音声のスタイル制御(一般, STRAIGHTスペシャルセッション(SS))
- 重回帰HSMMに基づく合成音声のスタイル制御のための平均声からの話者適応手法(合成,生成,韻律,一般)
- 重回帰HMMに基づくスタイル推定を用いた音声認識における音響モデル学習法(音声認識・音響モデル,第10回音声言語シンポジウム)
- 重回帰HMMに基づくスタイル推定を用いた音声認識における音響モデル学習法(音声認識・音響モデル,第10回音声言語シンポジウム)
- スタイル推定に基づく音響モデルのオンライン適応手法(認識,理解,対話,一般)
- HMM音声合成システム(HTS)の開発(システム,第9回音声言語シンポジウム)
- HMM音声合成システム(HTS)の開発(システム,第9回音声言語シンポジウム)
- HMM音声合成システム(HTS)の開発(システム,第9回音声言語シンポジウム)
- F0量子化と非パラレル学習に基づく声質変換の評価(テーマセッション,クロスモーダル)
- F0量子化と非パラレル学習に基づく声質変換の評価(テーマセッション,クロスモーダル)
- F0量子化と非パラレル学習に基づく声質変換の評価(テーマセッション,クロスモーダル)
- F0量子化と非パラレル学習に基づく声質変換の評価(テーマセッション,クロスモーダル)
- F0量子化と非パラレル学習に基づく声質変換の検討(一般(ポスターセッション),第11回音声言語シンポジウム)
- F0量子化と非パラレル学習に基づく声質変換の検討(一般(ポスターセッション),第11回音声言語シンポジウム)
- 平均声に基づく対話音声合成に関する検討(テーマセッション,クロスモーダル)
- 平均声に基づく対話音声合成に関する検討(テーマセッション,クロスモーダル)
- 平均声に基づく対話音声合成に関する検討(テーマセッション,クロスモーダル)
- 平均声に基づく対話音声合成に関する検討(テーマセッション,クロスモーダル)
- F0量子化に基づく韻律コンテキストを用いたHMM音声合成(一般(ポスターセッション),第11回音声言語シンポジウム)
- F0量子化に基づく韻律コンテキストを用いたHMM音声合成(一般(ポスターセッション),第11回音声言語シンポジウム)
- 極低ビットレートボコーダのためのHMMに基づくF0符号化法の検討(一般(ポスターセッション),第12回音声言語シンポジウム:情報アクセス,音声・言語処理一般)
- 極低ビットレートボコーダのためのHMMに基づくF0符号化法の検討(一般(ポスターセッション),第12回音声言語シンポジウム:情報アクセス,音声・言語処理一般)
- 日本語話し言葉コーパスを用いた対話音声合成のためのコンテキストの評価(一般,音声・音響信号処理,音声及び一般)
- 日本語話し言葉コーパスを用いた対話音声合成のためのコンテキストの評価(一般,音声・音響信号処理,音声及び一般)
- 日本語話し言葉コーパスを用いた対話音声合成のためのコンテキストの評価(一般,音声・音響信号処理,音声及び一般)
- HMMに基づく対話音声合成における多様な韻律生成のためのコンテクストの拡張(音声、聴覚,学生論文)
- 強調音声合成のための局所韻律コンテキスト自動付与の検討
- 韻律イベントHMMを用いた対話音声F0生成(音声合成,第13回音声言語シンポジウム)
- 韻律イベントHMMを用いた対話音声F0生成(音声合成,第13回音声言語シンポジウム)
- パラ言語情報を表現可能な対話音声合成のための重回帰HSMMの検討(音声合成,第13回音声言語シンポジウム)
- パラ言語情報を表現可能な対話音声合成のための重回帰HSMMの検討(音声合成,第13回音声言語シンポジウム)
- HMM音声合成における不特定話者スタイル変換の検討(音声合成,第13回音声言語シンポジウム)
- HMM音声合成における不特定話者スタイル変換の検討(音声合成,第13回音声言語シンポジウム)
- HMM音声合成のための動的特徴量を用いた音素継続長モデリングの検討(音声合成,第13回音声言語シンポジウム)
- HMM音声合成のための動的特徴量を用いた音素継続長モデリングの検討(音声合成,第13回音声言語シンポジウム)
- パラ言語情報を表現可能な対話音声合成のための重回帰HSMMの検討
- HMM音声合成における不特定話者スタイル変換の検討
- HMM音声合成のための動的特徴量を用いた音素継続長モデリングの検討
- 韻律イベントHMMを用いた対話音声F0生成
- HMM音声合成のための動的特徴量を用いた音素継続長モデリングの検討
- 強調音声合成のための局所韻律コンテキスト自動付与の検討(一般,音声知覚生成/聴覚コミュニケーション,一般)
- パラ言語情報を表現可能な対話音声合成のための重回帰HSMMの検討
- HMM音声合成における不特定話者スタイル変換の検討
- 言語モデルと音響モデルを利用したアクセント句境界の自動推定
- HMM音声合成におけるスペクトル特徴量の局所変動のモデル化とパラメータ生成への適用(一般セッション,福祉と音声処理,一般)
- 任意話者の多様なスタイル生成のための話者正規化スタイル変換法の検討(オーガナイズドセッション「多様な音声・歌声の合成に向けて」,音声・言語・対話,一般)
- 多様な韻律生成のための多クラス局所韻律コンテキストの検討(オーガナイズドセッション「多様な音声・歌声の合成に向けて」,音声・言語・対話,一般)
- 多様な歌声合成のための重回帰HSMMに基づくスタイル制御法の検討(オーガナイズドセッション「多様な音声・歌声の合成に向けて」,音声・言語・対話,一般)
- 統計モデルに基づく音声合成における話者・スタイルの多様化(オーガナイズドセッション「多様な音声・歌声の合成に向けて」,音声・言語・対話,一般)