| 講演抄録/キーワード |
| 講演名 |
2024-02-29 10:30
年齢情報とのマルチタスク学習による高齢者音声認識の高精度化 ○新惠拓実・木内貴浩・若林佑幸・北岡教英(豊橋技科大) EA2023-64 SIP2023-111 SP2023-46 |
| 抄録 |
(和) |
高齢者の音声は,一般にスマートスピーカーなどに使用されている音声認識機では一般話者に比べて精度 が低くなってしまう.これは高齢者音声には発声器官の衰えや間延びの増加,発話速度の低下などがあり,音響的特 徴量に差があることが原因とされている.また,高齢者音声データは収録が容易ではなく,データ量が少ないといっ た事も高齢者音声の認識精度を向上できない理由の一つとして挙げられる.本研究では,年齢推定タスクを同時に行 うマルチタスクモデルを用いることで,認識精度の向上を試みた.一つ目に,純粋に年齢推定を行いながら音声認識 を行うことで年齢情報を考慮した音声認識が可能になるモデルを構築した.二つ目に,年齢推定タスクと音声認識タ スクで敵対的マルチタスク学習を行うことで,一般成人と高齢者に共通する年齢不変な音響特徴量を抽出し,学習を 進めることで認識精度の向上を狙うモデルを構築した.また,三つ目に年齢推定器を改良したマルチタスク学習モデ ルを構築した.これらのモデルの精度を比較し,考察を行った.結果として高齢者の音声だけでなく一般成人に対す る認識精度も改善でき,マルチタスク学習の有用性を示した. |
| (英) |
The speech recognition of the elderly is less accurate, especially in smart speaker speech recognition, due to aging-related factors such as vocal organ deterioration, increased pauses, and decreased speech rate, leading to differences in acoustic features. Challenges include difficulty in recording elderly speech and limited data availability. The aim of this study is to enhance the accuracy of elderly speech recognition. As a proposed method, we built two models: one integrating age estimation into the speech recognition model and another employing adversarial multitask learning with GAN framework. Comparing the accuracy of these models revealed improved recognition for both elderly and general adult speech, demonstrating the effectiveness of the multitasking approach. |
| キーワード |
(和) |
高齢者音声 / 音声認識 / マルチタスク学習 / 敵対的マルチタスク学習 / / / / |
| (英) |
Elderly Speech / Speech Recognition / Multi-task Learning / Adversarial Multi-task Learning / / / / |
| 文献情報 |
信学技報, vol. 123, no. 403, SP2023-46, pp. 19-24, 2024年2月. |
| 資料番号 |
SP2023-46 |
| 発行日 |
2024-02-22 (EA, SIP, SP) |
| ISSN |
Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
EA2023-64 SIP2023-111 SP2023-46 |
| 研究会情報 |
| 研究会 |
SIP SP EA IPSJ-SLP |
| 開催期間 |
2024-02-29 - 2024-03-01 |
| 開催地(和) |
沖縄産業支援センター |
| 開催地(英) |
|
| テーマ(和) |
音声,応用/電気音響, 信号処理,一般 |
| テーマ(英) |
|
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2024-02-SIP-SP-EA-SLP |
| 本文の言語 |
日本語 |
| タイトル(和) |
年齢情報とのマルチタスク学習による高齢者音声認識の高精度化 |
| サブタイトル(和) |
|
| タイトル(英) |
Multi-task learning with age information model for highly accurate elderly speech recognition. |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
高齢者音声 / Elderly Speech |
| キーワード(2)(和/英) |
音声認識 / Speech Recognition |
| キーワード(3)(和/英) |
マルチタスク学習 / Multi-task Learning |
| キーワード(4)(和/英) |
敵対的マルチタスク学習 / Adversarial Multi-task Learning |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
新惠 拓実 / Shine Takumi / シンエ タクミ |
| 第1著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第2著者 氏名(和/英/ヨミ) |
木内 貴浩 / Kinouchi Takahiro / キノウチ タカヒロ |
| 第2著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第3著者 氏名(和/英/ヨミ) |
若林 佑幸 / Wakabayashi Yukoh / ワカバヤシ ユウコウ |
| 第3著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第4著者 氏名(和/英/ヨミ) |
北岡 教英 / Kitaoka Norihide / キタオカ ノリヒデ |
| 第4著者 所属(和/英) |
豊橋技術科学大学 (略称: 豊橋技科大)
Toyohashi University of Technology (略称: TUT) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2024-02-29 10:30:00 |
| 発表時間 |
20分 |
| 申込先研究会 |
SP |
| 資料番号 |
EA2023-64, SIP2023-111, SP2023-46 |
| 巻番号(vol) |
vol.123 |
| 号番号(no) |
no.401(EA), no.402(SIP), no.403(SP) |
| ページ範囲 |
pp.19-24 |
| ページ数 |
6 |
| 発行日 |
2024-02-22 (EA, SIP, SP) |
|