| 講演抄録/キーワード |
| 講演名 |
2022-11-29 14:35
Density Ratio Approachに基づく複数Encoder-Decoder音声認識モデル統合手法 ○北條圭悟・森 大輝・若林佑幸(豊橋技科大)・小川厚徳(NTT)・北岡教英(豊橋技科大) NLC2022-10 SP2022-30 |
| 抄録 |
(和) |
Encoder--Decoder音声認識の性能を改善する手法として音声認識モデルと言語モデルの統合がある.音声認識モデルと言語モデルの統合手法の一つとして,Density Ratio Approach(DRA)が登場し,標準的な統合手法であるshallow fusionの性能を上回ることが判明した.我々はこのDRAを応用し,複数の音声認識モデルを併用し,それらが持つ情報を統合することで得られる頑健な音響情報と音声認識モデルが学習していない言語情報を統合する手法を提案する.この提案手法の有効性を検証するため,文字誤り率を用いて従来の統合手法との比較を行った.実験の結果,提案手法は1つの音声認識モデルを使用した従来の統合手法よりも高い性能であることが確認された.また,提案手法で用いる複数の音声認識モデルの学習に用いたデータをすべて用いて学習された音声認識モデルの精度を超えることはできなかったが,新たな音声認識モデルを学習することなく,それに近い性能を得た. |
| (英) |
One of the methods to improve the performance of Encoder--Decoder speech recognition is the integration of an ASR models and a language model. Based on the Density Ratio Approach, we propose a method to build an ASR system by integrating multiple ASR models and combining them with an external language models. The proposed method enables speech recognition use a variety of acoustic information and linguistic information that has not been learned by the ASR models. Experimental results show that the proposed method is more accurate than conventional integration methods. |
| キーワード |
(和) |
複数ASRモデル / 音響情報の統合 / 言語モデルの置換 / Density Ratio Approach / / / / |
| (英) |
Multiple ASR model / Integration of acoustic information / Language model replacement / Density Ratio Approach / / / / |
| 文献情報 |
信学技報, vol. 122, no. 288, SP2022-30, pp. 5-9, 2022年11月. |
| 資料番号 |
SP2022-30 |
| 発行日 |
2022-11-22 (NLC, SP) |
| ISSN |
Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
NLC2022-10 SP2022-30 |
| 研究会情報 |
| 研究会 |
NLC IPSJ-NL SP IPSJ-SLP |
| 開催期間 |
2022-11-29 - 2022-12-01 |
| 開催地(和) |
機械振興会館 |
| 開催地(英) |
|
| テーマ(和) |
第24回音声言語および第9回自然言語処理シンポジウム |
| テーマ(英) |
|
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2022-11-NLC-NL-SP-SLP |
| 本文の言語 |
日本語 |
| タイトル(和) |
Density Ratio Approachに基づく複数Encoder-Decoder音声認識モデル統合手法 |
| サブタイトル(和) |
|
| タイトル(英) |
Density Ratio Approach-based multiple Encoder-Decoder ASR model integration |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
複数ASRモデル / Multiple ASR model |
| キーワード(2)(和/英) |
音響情報の統合 / Integration of acoustic information |
| キーワード(3)(和/英) |
言語モデルの置換 / Language model replacement |
| キーワード(4)(和/英) |
Density Ratio Approach / Density Ratio Approach |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
北條 圭悟 / Keigo Hojo / ホウジョウ ケイゴ |
| 第1著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第2著者 氏名(和/英/ヨミ) |
森 大輝 / Daiki Mori / モリ ダイキ |
| 第2著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第3著者 氏名(和/英/ヨミ) |
若林 佑幸 / Yukoh Wakabayashi / ワカバヤシ ユウコウ |
| 第3著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第4著者 氏名(和/英/ヨミ) |
小川 厚徳 / Atsunori Ogawa / オガワ アツノリ |
| 第4著者 所属(和/英) |
日本電信電話株式会社 (略称: NTT)
NIPPON TELEGRAPH AND TELEPHONE CORPORATION (略称: NTT) |
| 第5著者 氏名(和/英/ヨミ) |
北岡 教英 / Norihide Kitaoka / キタオカ ノリヒデ |
| 第5著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2022-11-29 14:35:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
SP |
| 資料番号 |
NLC2022-10, SP2022-30 |
| 巻番号(vol) |
vol.122 |
| 号番号(no) |
no.287(NLC), no.288(SP) |
| ページ範囲 |
pp.5-9 |
| ページ数 |
5 |
| 発行日 |
2022-11-22 (NLC, SP) |