| 講演抄録/キーワード |
| 講演名 |
2017-01-21 11:00
[ポスター講演]読み上げ音声を利用したニューラルネットワークに基づく歌唱者非依存歌声変換の検討 ○小池治憲・能勢 隆・伊藤彰則(東北大) SP2016-67 |
| 抄録 |
(和) |
従来の声質変換手法は元話者の音声を用いた事前学習が必要であるという問題点がある.我々はこれを解決する手法として,複数の元話者と目標話者間で多対一マッピングを行うニューラルネットワークを用いることで任意の入力話者の話者性を特定の目標話者へ近づける手法を提案した.さらにこの手法では,変換に差分スペクトルフィルタを用いることでより自然性の高い変換音声が得られる.この研究では読み上げ音声の変換を対象として評価しているが,カラオケなどへの応用を考えると歌声の変換についても検討する必要がある.提案手法を歌声変換に適用する際に,本来であればニューラルネットワークの学習に歌唱音声を用いることが妥当であると考えられるが,そのためには学習に用いる大量の歌唱者のパラレルな歌唱音声の収録が必要となり,読み上げ音声と比較して非常にコストが高い.そこで本稿では,読み上げ音声を学習に利用したニューラルネットワークに基づく歌唱者非依存歌声変換について検討する.評価実験により,学習に歌唱音声を用いた歌唱者依存の手法より自然性の高い変換歌唱音声が得られること,複数の歌唱者から単一の目標歌唱者への多対一変換が行えることを示す. |
| (英) |
There is a problem that the conventional method requires the speech of the source speaker for training. We proposed a method of voice conversion by which voice of an arbitrary input speaker can be converted closer to that of the specified target speaker using a neural network for many-to-one mapping between multiple source speakers and a target speaker to solve the problem. Furthermore, we can obtain more natural converted speech by using spectral differential filter. In this study, we evaluated the performance of conversion by read speech. Considering the application to karaoke, it is necessary to consider conversion of singing voice as well. It is ideal to use singing voice for training neural network, but it is extremely expensive to use parallel singing voice of a large number of singers. Therefore, in this paper, we study the singer-independent singing voice conversion based on a neural network using read speech for trainning. Evaluation experiments show that we can obtain more natural converted speech than singer-dependent method using singing voice and can perform many-to-one conversion from multiple singers to a single target singer. |
| キーワード |
(和) |
歌声声質変換 / ニューラルネットワーク / 歌唱者非依存変換 / 差分スペクトルフィルタ / 読み上げ音声 / / / |
| (英) |
singing voice conversion / neural network / singer-independent conversion / spectral differential filter / read speech / / / |
| 文献情報 |
信学技報, vol. 116, no. 414, SP2016-67, pp. 17-22, 2017年1月. |
| 資料番号 |
SP2016-67 |
| 発行日 |
2017-01-14 (SP) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2016-67 |
| 研究会情報 |
| 研究会 |
SP |
| 開催期間 |
2017-01-21 - 2017-01-21 |
| 開催地(和) |
東京大学 |
| 開催地(英) |
The University of Tokyo |
| テーマ(和) |
合成,生成,韻律,音声一般 |
| テーマ(英) |
Synthesis, Generation, Prosody, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2017-01-SP |
| 本文の言語 |
日本語 |
| タイトル(和) |
読み上げ音声を利用したニューラルネットワークに基づく歌唱者非依存歌声変換の検討 |
| サブタイトル(和) |
|
| タイトル(英) |
A Study on Singer-Independent Singing Voice Conversion Using Read Speech Based on Neural Network |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
歌声声質変換 / singing voice conversion |
| キーワード(2)(和/英) |
ニューラルネットワーク / neural network |
| キーワード(3)(和/英) |
歌唱者非依存変換 / singer-independent conversion |
| キーワード(4)(和/英) |
差分スペクトルフィルタ / spectral differential filter |
| キーワード(5)(和/英) |
読み上げ音声 / read speech |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
小池 治憲 / Harunori Koike / コイケ ハルノリ |
| 第1著者 所属(和/英) |
東北大学 (略称: 東北大)
Tohoku University (略称: Tohoku Univ.) |
| 第2著者 氏名(和/英/ヨミ) |
能勢 隆 / Takashi Nose / ノセ タカシ |
| 第2著者 所属(和/英) |
東北大学 (略称: 東北大)
Tohoku University (略称: Tohoku Univ.) |
| 第3著者 氏名(和/英/ヨミ) |
伊藤 彰則 / Akinori Ito / イトウ アキノリ |
| 第3著者 所属(和/英) |
東北大学 (略称: 東北大)
Tohoku University (略称: Tohoku Univ.) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2017-01-21 11:00:00 |
| 発表時間 |
60分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2016-67 |
| 巻番号(vol) |
vol.116 |
| 号番号(no) |
no.414 |
| ページ範囲 |
pp.17-22 |
| ページ数 |
6 |
| 発行日 |
2017-01-14 (SP) |