| 講演抄録/キーワード |
| 講演名 |
2012-07-21 10:00
雑音環境下における静的・動的情報を用いた音響モデル適応 ○田村哲嗣・速水 悟(岐阜大) SP2012-56 |
| 抄録 |
(和) |
本稿では,雑音環境下・実環境下での音声認識性能の改善を目的に,複数のストリームを用いた音響モデル適応手法を提案する.
はじめに,静的成分と動的成分($\Delta$成分と$\Delta\Delta$成分)などのように,音響特徴量を複数のストリームに分割する.
次に,予備的に認識を行い,その結果によりそれぞれのストリームの並び替えを行う.
モデル適応を行う際には,最も性能の高かったストリームでは,そのストリームの情報のみを用いてモデルパラメータの適応を行う.
それ以外のストリームにおいては,当該ストリームより性能の高かったストリームもあわせて用いることで,モデルパラメータの適応を行う.
提案手法の有効性を確認するため,コーパスCENSREC-1を用いて認識実験および適応実験を行った.
予備実験結果では,音響特徴量の動的成分が静的成分と比べて雑音に対する頑健性を有することが確かめられた.
適応・認識実験では,提案する適応手法は,従来の音響特徴量やストリームをそのまま用いる方法と比較して,最も高い認識性能を得ることができ,手法の有効性が確かめられた. |
| (英) |
In this paper, an acoustic model adaptation method based on multi streams is proposed for speech recognition in noisy or real environments.
At first, an acoustic feature vector is divided into several vectors (e.g. static, first-order and second-order dynamic vectors), namely streams.
Second, the order of streams is determined according to accuracies of pre-recognition results.
While adaptation, a stream performing the highest recognition performance is updated for the stream only.
Alternatively, a stream is adapted using all the streams that are superior to the stream.
In order to evaluate the proposed technique, recognition and adaptation experiments were conducted using a corpus CENSREC-1.
Pre-recognition results show dynamic features are more robust to noise than static parameters.
And through adaptation experiments it is found that our proposed method achieved the best performance compared to conventional acoustic feature and its streams.
These results show the effectiveness of our proposed adaptation scheme. |
| キーワード |
(和) |
雑音下音声認識 / マルチストリーム / モデル適応 / MAP / MLLR / CENSREC / / |
| (英) |
speech recognition in noisy condition / multi stream / model adaptation / MAP / MLLR / CENSREC / / |
| 文献情報 |
信学技報, vol. 112, no. 141, SP2012-56, pp. 33-38, 2012年7月. |
| 資料番号 |
SP2012-56 |
| 発行日 |
2012-07-12 (SP) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2012-56 |
| 研究会情報 |
| 研究会 |
SP IPSJ-SLP |
| 開催期間 |
2012-07-19 - 2012-07-21 |
| 開催地(和) |
滝の湯(山形・天童温泉) |
| 開催地(英) |
Hotel Takinoyu (Yamagata Pref.) |
| テーマ(和) |
認識,理解,対話,一般 |
| テーマ(英) |
Speech recognition, understanding, dialog, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2012-07-SP-SLP |
| 本文の言語 |
日本語 |
| タイトル(和) |
雑音環境下における静的・動的情報を用いた音響モデル適応 |
| サブタイトル(和) |
|
| タイトル(英) |
Acoustic model adaptation choosing static and dynamic streams in noisy environments |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
雑音下音声認識 / speech recognition in noisy condition |
| キーワード(2)(和/英) |
マルチストリーム / multi stream |
| キーワード(3)(和/英) |
モデル適応 / model adaptation |
| キーワード(4)(和/英) |
MAP / MAP |
| キーワード(5)(和/英) |
MLLR / MLLR |
| キーワード(6)(和/英) |
CENSREC / CENSREC |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
田村 哲嗣 / Satoshi Tamura / タムラ サトシ |
| 第1著者 所属(和/英) |
岐阜大学 (略称: 岐阜大)
Gifu University (略称: Gifu Univ.) |
| 第2著者 氏名(和/英/ヨミ) |
速水 悟 / Satoru Hayamizu / |
| 第2著者 所属(和/英) |
岐阜大学 (略称: 岐阜大)
Gifu University (略称: Gifu Univ.) |
| 第3著者 氏名(和/英/ヨミ) |
/ / |
| 第3著者 所属(和/英) |
(略称: )
(略称: ) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2012-07-21 10:00:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2012-56 |
| 巻番号(vol) |
vol.112 |
| 号番号(no) |
no.141 |
| ページ範囲 |
pp.33-38 |
| ページ数 |
6 |
| 発行日 |
2012-07-12 (SP) |
|