ご案内 入会して研究会活動をもっとお得に!研究会参加費・年間登録費が会員価格になります。
お知らせ 【重要】研究会参加費の支払いおよび原稿アップロード手続きの変更に関するご案内
電子情報通信学会 研究会発表申込システム
講演論文 詳細
技報閲覧サービス
[ログイン]
技報アーカイブ
 トップに戻る 前のページに戻る   [Japanese] / [English] 

講演抄録/キーワード
講演名 2014-05-24 11:30
[一般発表]非同期音声収録を用いた遠隔発話音声認識
寺岡俊汰・○上田雄磨静岡大)・王 龍標長岡技科大)・甲斐充彦福島 拓静岡大SP2014-16
抄録 (和) 携帯端末を使用したアプリケーションへの注目は高まっているが,複数の携帯端末を用いた非同期音声収録による遠隔発話音声認識に着目した研究は少ない.本研究では,非同期音声収録を前提とした遠隔発話環境に頑健な音声認識システムを提案する.本研究で提案するシステムは,まず残響抑圧のためにケプストラム領域でdenoising autoencoder(DAE) を適用し大語彙連続音声認識(LVCSR) を行う.その後,音声セグメント単位での収録マイクチャンネル(携帯端末) の自動選択と環境適応を行うことで実現する.提案手法は,WSJCAM0 コーパスからの発話を複数のスピーカーから発し,それを遠方に設置された複数の携帯端末で録音することで疑似的な会議音声を作成し評価する.ケプストラム領域でのDAE と自動的な携帯端末選択,環境適応を統合することで,単語誤り率(WER) はベースラインである51.8%から28.8%まで削減,すなわち44.4%の相対誤り削減率を達成した. 
(英) Although applications using mobile terminals have attracted increasing attention, there are few studies that focus on distant-talking speech recognition with asynchronous recording using several mobile terminals. In this paper, we propose a robust distant-talking speech recognition system with asynchronous speech recording. For the system proposed in this paper, after applying a denoising autoencoder in the cepstral-domain of speech to suppress reverberation and performing Large Vocabulary Continuous Speech Recognition (LVCSR), we adopted automatic asynchronous mobile terminal selection and environment adaptation using speech segments from optimal mobile terminals. The proposed method was evaluated using a reverberant WSJCAM0 corpus, which was emitted by a loudspeaker and recorded in a meeting room with multiple speakers by far- eld multiple mobile terminals. By integrating a cepstral-domain denoising autoencoder and automatic mobile terminal selection with environment adaptation, the average Word Error Rate (WER) was reduced from 51.8% of the baseline system to 28.8%, i.e., the relative error reduction rate was 44.4% when using multi-condition acoustic models.
キーワード (和) 遠隔発話音声認識 / 非同期音声収録 / 残響除去 / denoising autoencoder (DAE) / deep neural network (DNN) / 環境適応 / /  
(英) distant-talking speech recognition / asynchronous speech recording / dereverberation / denoising autoen- coder (DAE) / deep neural network (DNN) / environment adaptation / /  
文献情報 信学技報, vol. 114, no. 52, SP2014-16, pp. 153-157, 2014年5月.
資料番号 SP2014-16 
発行日 2014-05-17 (SP) 
ISSN Print edition: ISSN 0913-5685    Online edition: ISSN 2432-6380
著作権に
ついて
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034)
PDFダウンロード SP2014-16

研究会情報
研究会 SP IPSJ-MUS  
開催期間 2014-05-24 - 2014-05-25 
開催地(和) 日本大学文理学部キャンパス 百周年記念館 
開催地(英)  
テーマ(和) 音学シンポジウム2014 
テーマ(英)  
講演論文情報の詳細
申込み研究会 SP 
会議コード 2014-05-SP-MUS 
本文の言語 日本語 
タイトル(和) [一般発表]非同期音声収録を用いた遠隔発話音声認識 
サブタイトル(和)  
タイトル(英) Distant-talking Speech Recognition with Asynchronous Speech Recording 
サブタイトル(英)  
キーワード(1)(和/英) 遠隔発話音声認識 / distant-talking speech recognition  
キーワード(2)(和/英) 非同期音声収録 / asynchronous speech recording  
キーワード(3)(和/英) 残響除去 / dereverberation  
キーワード(4)(和/英) denoising autoencoder (DAE) / denoising autoen- coder (DAE)  
キーワード(5)(和/英) deep neural network (DNN) / deep neural network (DNN)  
キーワード(6)(和/英) 環境適応 / environment adaptation  
キーワード(7)(和/英) /  
キーワード(8)(和/英) /  
第1著者 氏名(和/英/ヨミ) 寺岡 俊汰 / Shunta Teraoka / テラオカ シュンタ
第1著者 所属(和/英) 静岡大学 (略称: 静岡大)
Shizuoka University (略称: Shizuoka Univ.)
第2著者 氏名(和/英/ヨミ) 上田 雄磨 / Yuma Ueda / ウエダ ユウマ
第2著者 所属(和/英) 静岡大学 (略称: 静岡大)
Shizuoka University (略称: Shizuoka Univ.)
第3著者 氏名(和/英/ヨミ) 王 龍標 / Longbiao Wang / オウ リュウヒョウ
第3著者 所属(和/英) 長岡技術科学大学 (略称: 長岡技科大)
Nagaoka University of Technology (略称: Nagaoka Univ. of Tech.)
第4著者 氏名(和/英/ヨミ) 甲斐 充彦 / Atsuhiko Kai / カイ アツヒコ
第4著者 所属(和/英) 静岡大学 (略称: 静岡大)
Shizuoka University (略称: Shizuoka Univ.)
第5著者 氏名(和/英/ヨミ) 福島 拓 / Taku Fukushima / フクシマ タク
第5著者 所属(和/英) 静岡大学 (略称: 静岡大)
Shizuoka University (略称: Shizuoka Univ.)
第6著者 氏名(和/英/ヨミ) / /
第6著者 所属(和/英) (略称: )
(略称: )
第7著者 氏名(和/英/ヨミ) / /
第7著者 所属(和/英) (略称: )
(略称: )
第8著者 氏名(和/英/ヨミ) / /
第8著者 所属(和/英) (略称: )
(略称: )
第9著者 氏名(和/英/ヨミ) / /
第9著者 所属(和/英) (略称: )
(略称: )
第10著者 氏名(和/英/ヨミ) / /
第10著者 所属(和/英) (略称: )
(略称: )
第11著者 氏名(和/英/ヨミ) / /
第11著者 所属(和/英) (略称: )
(略称: )
第12著者 氏名(和/英/ヨミ) / /
第12著者 所属(和/英) (略称: )
(略称: )
第13著者 氏名(和/英/ヨミ) / /
第13著者 所属(和/英) (略称: )
(略称: )
第14著者 氏名(和/英/ヨミ) / /
第14著者 所属(和/英) (略称: )
(略称: )
第15著者 氏名(和/英/ヨミ) / /
第15著者 所属(和/英) (略称: )
(略称: )
第16著者 氏名(和/英/ヨミ) / /
第16著者 所属(和/英) (略称: )
(略称: )
第17著者 氏名(和/英/ヨミ) / /
第17著者 所属(和/英) (略称: )
(略称: )
第18著者 氏名(和/英/ヨミ) / /
第18著者 所属(和/英) (略称: )
(略称: )
第19著者 氏名(和/英/ヨミ) / /
第19著者 所属(和/英) (略称: )
(略称: )
第20著者 氏名(和/英/ヨミ) / /
第20著者 所属(和/英) (略称: )
(略称: )
第21著者 氏名(和/英/ヨミ) / /
第21著者 所属(和/英) (略称: )
(略称: )
第22著者 氏名(和/英/ヨミ) / /
第22著者 所属(和/英) (略称: )
(略称: )
第23著者 氏名(和/英/ヨミ) / /
第23著者 所属(和/英) (略称: )
(略称: )
第24著者 氏名(和/英/ヨミ) / /
第24著者 所属(和/英) (略称: )
(略称: )
第25著者 氏名(和/英/ヨミ) / /
第25著者 所属(和/英) (略称: )
(略称: )
第26著者 氏名(和/英/ヨミ) / /
第26著者 所属(和/英) (略称: )
(略称: )
第27著者 氏名(和/英/ヨミ) / /
第27著者 所属(和/英) (略称: )
(略称: )
第28著者 氏名(和/英/ヨミ) / /
第28著者 所属(和/英) (略称: )
(略称: )
第29著者 氏名(和/英/ヨミ) / /
第29著者 所属(和/英) (略称: )
(略称: )
第30著者 氏名(和/英/ヨミ) / /
第30著者 所属(和/英) (略称: )
(略称: )
第31著者 氏名(和/英/ヨミ) / /
第31著者 所属(和/英) (略称: )
(略称: )
第32著者 氏名(和/英/ヨミ) / /
第32著者 所属(和/英) (略称: )
(略称: )
第33著者 氏名(和/英/ヨミ) / /
第33著者 所属(和/英) (略称: )
(略称: )
第34著者 氏名(和/英/ヨミ) / /
第34著者 所属(和/英) (略称: )
(略称: )
第35著者 氏名(和/英/ヨミ) / /
第35著者 所属(和/英) (略称: )
(略称: )
第36著者 氏名(和/英/ヨミ) / /
第36著者 所属(和/英) (略称: )
(略称: )
講演者 第2著者 
発表日時 2014-05-24 11:30:00 
発表時間 240分 
申込先研究会 SP 
資料番号 SP2014-16 
巻番号(vol) vol.114 
号番号(no) no.52 
ページ範囲 pp.153-157 
ページ数
発行日 2014-05-17 (SP) 


[研究会発表申込システムのトップページに戻る]

[電子情報通信学会ホームページ]


IEICE / 電子情報通信学会