| 講演抄録/キーワード |
| 講演名 |
2023-03-14 15:25
条件付きVAEによる印象情報を反映した音色合成手法 ~ 印象による条件付けと音波形の生成 ~ ○渡邉 健・黒柳 奨(名工大) NC2022-106 |
| 抄録 |
(和) |
音色と人間が抱く印象の関係性を体系立てて説明することは難しく,音色のデザインにおいては経験や感 覚に大きく依存している側面が強い.この現状を踏まえ,本稿では人間が想起する印象にもとづいた音色合成手法の 提案を目的とする.具体的には深層生成モデルの一種である条件付き変分オートエンコーダ (Conditional Variational Auto Encoder:CVAE) を用いて,印象情報で条件付けを行い音の波形を生成する手法を提案する.本提案モデルは,主 となる一波長分の波形を直接生成する波形生成モデルと学習時に補助的に用いられる印象推定モデルの二部で構成さ れる.このような二部構成を採用することで,大量のラベル付きデータセットを用意することなく印象の条件付けを 可能とし,多様な波形生成と印象の反映の両立を目指す.本稿では波形の概形の変化に対する検証と被験者による聴 取実験を行い,本提案手法の有効性を示した. |
| (英) |
In This paper, we aim to propose a method of timbre synthesis based on impressions recalled by humans. We worked on this study with the aim of alleviating the current situation in which designers are forced to rely heavily on their experience and senses when designing tones due to the difficulty of systematically explaining the relationship between tones and human impressions of them. Specifically, we propose a method for generating sound waveforms using a conditional variational autoencoder(CVAE), a type of deep generative model, by further conditioning with impression information. The proposed model consists of two parts: a main waveform generation model that directly generates a waveform for one wavelength, and an impression estimation model that is used as an auxiliary model during training. This two-part structure enables impression conditioning without preparing a large amount of labeled data sets, and is expected to both generate a variety of waveforms and reflect impressions. Finally, verification against changes in the approximate shape of the waveform and listening experiments with subjects are conducted to demonstrate the effectiveness of the proposed method. |
| キーワード |
(和) |
音色合成 / 条件付き変分自己符号化器 / 印象 / / / / / |
| (英) |
Timbre synthesis / Conditional variational autoencoder / Impression / / / / / |
| 文献情報 |
信学技報, vol. 122, no. 425, NC2022-106, pp. 84-89, 2023年3月. |
| 資料番号 |
NC2022-106 |
| 発行日 |
2023-03-06 (NC) |
| ISSN |
Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
NC2022-106 |
| 研究会情報 |
| 研究会 |
NC MBE |
| 開催期間 |
2023-03-13 - 2023-03-15 |
| 開催地(和) |
電気通信大学 |
| 開催地(英) |
The Univ. of Electro-Communications |
| テーマ(和) |
脳アーキテクチャー, 一般(NC, ME) |
| テーマ(英) |
Brain architecture, General |
| 講演論文情報の詳細 |
| 申込み研究会 |
NC |
| 会議コード |
2023-03-NC-MBE |
| 本文の言語 |
日本語 |
| タイトル(和) |
条件付きVAEによる印象情報を反映した音色合成手法 |
| サブタイトル(和) |
印象による条件付けと音波形の生成 |
| タイトル(英) |
A Method of Timbre Synthesis Reflecting Impression Using Conditional-VAE |
| サブタイトル(英) |
Conditioning by Impression and Generating Sound Waveforms |
| キーワード(1)(和/英) |
音色合成 / Timbre synthesis |
| キーワード(2)(和/英) |
条件付き変分自己符号化器 / Conditional variational autoencoder |
| キーワード(3)(和/英) |
印象 / Impression |
| キーワード(4)(和/英) |
/ |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
渡邉 健 / Takeru Watanabe / ワタナベ タケル |
| 第1著者 所属(和/英) |
名古屋工業大学 (略称: 名工大)
Nagoya Institute of Technology (略称: NIT) |
| 第2著者 氏名(和/英/ヨミ) |
黒柳 奨 / Susumu Kuroyanagi / クロヤナギ ススム |
| 第2著者 所属(和/英) |
名古屋工業大学 (略称: 名工大)
Nagoya Institute of Technology (略称: NIT) |
| 第3著者 氏名(和/英/ヨミ) |
/ / |
| 第3著者 所属(和/英) |
(略称: )
(略称: ) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2023-03-14 15:25:00 |
| 発表時間 |
25分 |
| 申込先研究会 |
NC |
| 資料番号 |
NC2022-106 |
| 巻番号(vol) |
vol.122 |
| 号番号(no) |
no.425 |
| ページ範囲 |
pp.84-89 |
| ページ数 |
6 |
| 発行日 |
2023-03-06 (NC) |
|