| 講演抄録/キーワード |
| 講演名 |
2013-01-31 14:45
多様な歌声合成のための重回帰HSMMに基づくスタイル制御法の検討 ○能勢 隆・金本美沙・郡山知樹・小林隆夫(東工大) SP2012-111 |
| 抄録 |
(和) |
本稿では,HMMに基づく歌声合成における合成音声の多様化を目的とし,
合成音声に現れるスタイルとその度合を直観的に操作できる
重回帰HSMMに基づくスタイル制御法を提案する.
提案法では,学習データに含まれるスタイルとその表出度合をスタイルベクトルと呼ばれる
低次元のベクトルにより表し,これを説明変数とした重回帰により
モデルの各分布の平均パラメータを表現することでスタイルとその度合を明示的にモデル化する.
合成時には所望のスタイルベクトルを与えることで,
各スタイルの度合を弱める,あるいは強調することができる.
さらに提案法では,限られた学習データで精度よく音高をモデル化するため,楽譜情報を利用した
音高正規化学習を重回帰HSMMに導入する.
また,ビブラートが顕著でない歌唱音声においても安定してビブラートパラメータを抽出できる手法を提案し,
これらにより自然性を保ったまま,合成音声の歌唱スタイルを直観的に制御できることを主観評価により示す. |
| (英) |
This paper proposes a style control technique based on multiple regression HSMM (MRHSMM)
for changing styles and their intensities appearing in synthetic singing voices.
In the proposed technique, styles and their intensities are represented by
low-dimensional vectors called style vectors and are modeled by
an assumption that mean parameters of acoustic models
are given as multiple regressions of the style vectors.
When synthesizing speech, we can weaken or emphasize the intensity of each style
by setting a desired style vector.
In addition, the idea of pitch adaptive training is introduced into the MRHSMM
to improve the modeling accuracy of F0 associated with musical notes.
The novel vibrato modeling technique is also presented to extract
vibrato parameters from singing voices that sometimes have unclear vibrato expressions.
Subjective evaluations show that we can intuitively contorol styles and their intensities
while keeping naturalness of synthetic speech. |
| キーワード |
(和) |
HMM歌声合成 / HMM音声合成 / スタイル制御 / 重回帰HSMM / 音高正規化学習 / ビブラートモデル / / |
| (英) |
HMM-based singing voice synthesis / HMM-based speech synthesis / style control / multiple-regression HSMM / pitch adaptive training / vibrato modeling / / |
| 文献情報 |
信学技報, vol. 112, no. 422, SP2012-111, pp. 79-84, 2013年1月. |
| 資料番号 |
SP2012-111 |
| 発行日 |
2013-01-23 (SP) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2012-111 |
| 研究会情報 |
| 研究会 |
SP |
| 開催期間 |
2013-01-30 - 2013-01-31 |
| 開催地(和) |
同志社大学 |
| 開催地(英) |
Doshisha Univ. |
| テーマ(和) |
音声・言語・対話,一般 |
| テーマ(英) |
Speech, Language, and Dialogue, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2013-01-SP |
| 本文の言語 |
日本語 |
| タイトル(和) |
多様な歌声合成のための重回帰HSMMに基づくスタイル制御法の検討 |
| サブタイトル(和) |
|
| タイトル(英) |
A Study on Style Control Based on Multiple-Regression HSMM for Synthesizing Singing Voices with Various Expressivity |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
HMM歌声合成 / HMM-based singing voice synthesis |
| キーワード(2)(和/英) |
HMM音声合成 / HMM-based speech synthesis |
| キーワード(3)(和/英) |
スタイル制御 / style control |
| キーワード(4)(和/英) |
重回帰HSMM / multiple-regression HSMM |
| キーワード(5)(和/英) |
音高正規化学習 / pitch adaptive training |
| キーワード(6)(和/英) |
ビブラートモデル / vibrato modeling |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
能勢 隆 / Takashi Nose / ノセ タカシ |
| 第1著者 所属(和/英) |
東京工業大学 (略称: 東工大)
Tokyo Institute of Technology (略称: Tokyo Inst. of Tech.) |
| 第2著者 氏名(和/英/ヨミ) |
金本 美沙 / Misa Kanemoto / カネモト ミサ |
| 第2著者 所属(和/英) |
東京工業大学 (略称: 東工大)
Tokyo Institute of Technology (略称: Tokyo Inst. of Tech.) |
| 第3著者 氏名(和/英/ヨミ) |
郡山 知樹 / Tomoki Koriyama / コオリヤマ トモキ |
| 第3著者 所属(和/英) |
東京工業大学 (略称: 東工大)
Tokyo Institute of Technology (略称: Tokyo Inst. of Tech.) |
| 第4著者 氏名(和/英/ヨミ) |
小林 隆夫 / Takao Kobayashi / コバヤシ タカオ |
| 第4著者 所属(和/英) |
東京工業大学 (略称: 東工大)
Tokyo Institute of Technology (略称: Tokyo Inst. of Tech.) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2013-01-31 14:45:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2012-111 |
| 巻番号(vol) |
vol.112 |
| 号番号(no) |
no.422 |
| ページ範囲 |
pp.79-84 |
| ページ数 |
6 |
| 発行日 |
2013-01-23 (SP) |