| 講演抄録/キーワード |
| 講演名 |
2008-05-29 16:05
複数残響特性下の音声を単一モデル学習に用いた未知残響環境に頑健な音声認識の検討 ○西亀健太(東大)・渡部晋治(NTT)・西本卓也・小野順貴・嵯峨山茂樹(東大) SP2008-8 WIT2008-8 |
| 抄録 |
(和) |
残響環境下では音声認識性能は著しく著しく劣化する.これに対し,人工残響インパルス応答をクリーン音声に畳み込んで学習することで,認識率が向上することが知られている.しかし,どのような残響インパルス応答を畳み込んで学習すべきか,という点に関しては十分に議論がなされていない.本研究では,人工残響インパルス応答の残響時間パラメータと認識率の関係を残響音声認識評価基盤(CENSREC-4)を用いて詳細に調べ,認識率が大きく変わる残響時間パラメータの範囲がテスト環境より短い残響時間に分布していることを述べる.また,その範囲に基づいて人工残響インパルス応答を選択しマルチコンディション学習をすることが,未知残響環境に対して頑健な音声認識であることを示す. |
| (英) |
In reverberant environment, speech recognition accuracy is seriously degraded. An effective method is to train acoustic models using reverberant speech which are generated from clean speech data and reverberant impulse response. It is not clear, however, what kind of impulse response is suitable for environmental variations. In this research, we show the range of reverberant time that changes speech recognition accuracy drastically through evaluation with CENSREC-4. Then we point out that the range of reverberant time which is effective for model training is shorter than that of test conditions. We also show the multi-condition training is effective for speech recognition under unknown environments using speech data of the range of reverberant time we showed. |
| キーワード |
(和) |
残響環境 / モデル学習 / インパルス応答 / 音声認識 / 人工残響 / 残響時間 / / |
| (英) |
reverberant environment / model construction / impulse response / speech recognition / artificial reverberance / reverberation time / / |
| 文献情報 |
信学技報, vol. 108, no. 66, SP2008-8, pp. 43-48, 2008年5月. |
| 資料番号 |
SP2008-8 |
| 発行日 |
2008-05-22 (SP, WIT) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2008-8 WIT2008-8 |
| 研究会情報 |
| 研究会 |
SP WIT |
| 開催期間 |
2008-05-29 - 2008-05-30 |
| 開催地(和) |
神戸大 |
| 開催地(英) |
Kobe University |
| テーマ(和) |
福祉と音声処理,一般 |
| テーマ(英) |
Welfare and Speech Processing, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2008-05-SP-WIT |
| 本文の言語 |
日本語 |
| タイトル(和) |
複数残響特性下の音声を単一モデル学習に用いた未知残響環境に頑健な音声認識の検討 |
| サブタイトル(和) |
|
| タイトル(英) |
A Study on Robust Speech Recognition against Unknown Reverberation Using Single Speech Model Trained under Multiple Reverberant Environments |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
残響環境 / reverberant environment |
| キーワード(2)(和/英) |
モデル学習 / model construction |
| キーワード(3)(和/英) |
インパルス応答 / impulse response |
| キーワード(4)(和/英) |
音声認識 / speech recognition |
| キーワード(5)(和/英) |
人工残響 / artificial reverberance |
| キーワード(6)(和/英) |
残響時間 / reverberation time |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
西亀 健太 / Kenta Nishiki / ニシキ ケンタ |
| 第1著者 所属(和/英) |
東京大学 (略称: 東大)
Tokyo University (略称: Tokyo Univ.) |
| 第2著者 氏名(和/英/ヨミ) |
渡部 晋治 / Shinji Watanabe / ワタナベ シンジ |
| 第2著者 所属(和/英) |
日本電信電話株式会社 (略称: NTT)
NTT (略称: NTT) |
| 第3著者 氏名(和/英/ヨミ) |
西本 卓也 / Takuya Nishimoto / ニシモト タクヤ |
| 第3著者 所属(和/英) |
東京大学 (略称: 東大)
Tokyo University (略称: Tokyo Univ.) |
| 第4著者 氏名(和/英/ヨミ) |
小野 順貴 / Nobutaka Ono / オノ ノブタカ |
| 第4著者 所属(和/英) |
東京大学 (略称: 東大)
Tokyo University (略称: Tokyo Univ.) |
| 第5著者 氏名(和/英/ヨミ) |
嵯峨山 茂樹 / Shigeki Sagayama / サガヤマ シゲキ |
| 第5著者 所属(和/英) |
東京大学 (略称: 東大)
Tokyo University (略称: Tokyo Univ.) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2008-05-29 16:05:00 |
| 発表時間 |
25分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2008-8, WIT2008-8 |
| 巻番号(vol) |
vol.108 |
| 号番号(no) |
no.66(SP), no.67(WIT) |
| ページ範囲 |
pp.43-48 |
| ページ数 |
6 |
| 発行日 |
2008-05-22 (SP, WIT) |