| 講演抄録/キーワード |
| 講演名 |
2011-06-23 16:00
音声・画像のモダリティ間の相互作用に着目した音声認識のモデル適応 ○大西正真・田村哲嗣・速水 悟(岐阜大) SP2011-33 |
| 抄録 |
(和) |
本論文は,マルチモーダル音声認識におけるMLLR法を用いたモデル適応において,音響情報と画像情報がそれぞれ異なるモダリティに与える影響(モダリティ間の効果)について調査するものである.マルチモーダル音声認識のモデル適応ではモダリティ間の情報が音声認識の精度向上に有効に働いている可能性がある.そこで,モダリティ間の効果が有効であるか否か調査を行った.具体的には,MLLR法の変換行列にいくつかの変化を加えてモデル適応を行い認識精度を比較した.実験にはマルチモーダル音声認識コーパスに音響雑音を加えたデータを使用した.実験の結果から,モダリティ間の情報の有効性が確認された. |
| (英) |
This paper investigates a linear-regressive model adaptation method, i.e. MLLR (Maximum Likelihood Linear Regression), for multi-modal speech recognition focusing on audio-visual interaction, e.g. inter-modal influences. In the multi-modal adaptation, inter-modal information may contribute the performance of speech recognition. The influence and advantage of inter-modal elements, therefore, should be examined. Recognition experiments were conducted to evaluate several MLLR transformation matrices including or excluding inter-modal and intra-modal elements, using noisy data in an audio-visual corpus. From the experimental results, the importance of effective use of audio-visual interaction is clarified. |
| キーワード |
(和) |
マルチモーダル音声認識 / モデル適応 / モダリティ間の影響 / マルチーダル音声認識コーパス / / / / |
| (英) |
multi-modal speech recognition / model adaptation / inter-modal interaction / audio-visual corpus / / / / |
| 文献情報 |
信学技報, vol. 111, no. 97, SP2011-33, pp. 17-22, 2011年6月. |
| 資料番号 |
SP2011-33 |
| 発行日 |
2011-06-16 (SP) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2011-33 |
| 研究会情報 |
| 研究会 |
SP |
| 開催期間 |
2011-06-23 - 2011-06-24 |
| 開催地(和) |
名古屋大学 |
| 開催地(英) |
Nagoya Univ. |
| テーマ(和) |
音声・言語・音響教育,一般 |
| テーマ(英) |
|
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2011-06-SP |
| 本文の言語 |
日本語 |
| タイトル(和) |
音声・画像のモダリティ間の相互作用に着目した音声認識のモデル適応 |
| サブタイトル(和) |
|
| タイトル(英) |
Model Adaptation using Audio-visual Interaction for Multi-modal Speech Recognition |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
マルチモーダル音声認識 / multi-modal speech recognition |
| キーワード(2)(和/英) |
モデル適応 / model adaptation |
| キーワード(3)(和/英) |
モダリティ間の影響 / inter-modal interaction |
| キーワード(4)(和/英) |
マルチーダル音声認識コーパス / audio-visual corpus |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
大西 正真 / Masanao Oonishi / オオニシ マサナオ |
| 第1著者 所属(和/英) |
岐阜大学 (略称: 岐阜大)
Gifu University (略称: Gifu Univ.) |
| 第2著者 氏名(和/英/ヨミ) |
田村 哲嗣 / Satoshi Tamura / タムラ サトシ |
| 第2著者 所属(和/英) |
岐阜大学 (略称: 岐阜大)
Gifu University (略称: Gifu Univ.) |
| 第3著者 氏名(和/英/ヨミ) |
速水 悟 / Satoru Hayamizu / ハヤミズ サトル |
| 第3著者 所属(和/英) |
岐阜大学 (略称: 岐阜大)
Gifu University (略称: Gifu Univ.) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2011-06-23 16:00:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2011-33 |
| 巻番号(vol) |
vol.111 |
| 号番号(no) |
no.97 |
| ページ範囲 |
pp.17-22 |
| ページ数 |
6 |
| 発行日 |
2011-06-16 (SP) |