| 講演抄録/キーワード |
| 講演名 |
2008-07-18 10:50
複数音響環境の発話単位遷移モデルに基づく適応学習法の検討 ○渡部晋治・堀 貴明・中村 篤(NTT) SP2008-54 |
| 抄録 |
(和) |
対話や会議,放送などの実環境音声コミュニケーションで音声認識が対象とする音声には,話者・言語・ノイズ・話し方等の環境の時間変化が含まれる.我々は,このような環境の時間変化を扱うため,従来の音声認識が対象とする隠れマルコフモデル状態や単語連鎖などの時間単位と比べてスケールの大きい,発話や複数発話のまとまりであるチャンク単位での音響的特徴の長時間変化に注目し,巨視的な時間単位での連続的もしくは不連続的な音声特徴の時間発展モデルに対する研究を進めている.本論文では特に,音声特徴の巨視的な不連続時間変化に焦点を当て,これを複数の環境依存音声認識モデルの状態遷移モデルとして捉えてその一般的なモデル化及び学習アルゴリズムについて考察を行う.またその応用例として,複数音響環境の発話単位遷移モデルに基づく適応学習法について紹介する. |
| (英) |
Speech communication in realistic situations, as observed in, e.g, spoken dialogue, meeting and broadcast speech, is subject to significant temporal changes in acoustic environment, such as changes in noise, speaker, speaking style, and language. In order to handle such temporal change, we have proposed a time evolution system based on a macroscopic time scale that uses groups of successive utterances as the time unit. Such a time scale is larger than the Hidden Markov model (HMM) state and word units used in conventional speech recognition. Recently we have investigated both continuous and discrete time evolution of speech features based on this macroscopic time unit. In this paper, we focus on discrete temporal changes in speech feature at the macroscopic level, and model the corresponding time series as the result of state transitions between multiple environment-dependent speech recognition models. We discuss a general framework for this model and its training algorithm, and present, as an application of this framework, a novel adaptive training method based on a model of utterance-unit transition between multiple acoustic environments. |
| キーワード |
(和) |
音声認識 / 複数音響環境 / 適応学習 / 発話単位遷移モデル / 有限状態トランスデューサ / / / |
| (英) |
Speech recognition / multiple acoustic environments / adaptive training / model of utterance-unit transition / weighted finite state transducer / / / |
| 文献情報 |
信学技報, vol. 108, no. 142, SP2008-54, pp. 67-72, 2008年7月. |
| 資料番号 |
SP2008-54 |
| 発行日 |
2008-07-10 (SP) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2008-54 |
| 研究会情報 |
| 研究会 |
SP |
| 開催期間 |
2008-07-17 - 2008-07-19 |
| 開催地(和) |
岩手県大 |
| 開催地(英) |
Iwate Prefectural Univ. |
| テーマ(和) |
認識,理解,対話,一般 |
| テーマ(英) |
Speech Recognition, Speech Understanding, Speech Dialogue, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2008-07-SP |
| 本文の言語 |
日本語 |
| タイトル(和) |
複数音響環境の発話単位遷移モデルに基づく適応学習法の検討 |
| サブタイトル(和) |
|
| タイトル(英) |
A study on adaptive training method based on a model of utterance-unit transitions between multiple acoustic environments. |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
音声認識 / Speech recognition |
| キーワード(2)(和/英) |
複数音響環境 / multiple acoustic environments |
| キーワード(3)(和/英) |
適応学習 / adaptive training |
| キーワード(4)(和/英) |
発話単位遷移モデル / model of utterance-unit transition |
| キーワード(5)(和/英) |
有限状態トランスデューサ / weighted finite state transducer |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
渡部 晋治 / Shinji Watanabe / ワタナベ シンジ |
| 第1著者 所属(和/英) |
日本電信電話株式会社 NTTコミュニケーション科学基礎研究所 (略称: NTT)
NTT Communication Sciene Laboratories, NTT Corporation (略称: NTT) |
| 第2著者 氏名(和/英/ヨミ) |
堀 貴明 / Takaaki Hori / ホリ タカアキ |
| 第2著者 所属(和/英) |
日本電信電話株式会社 NTTコミュニケーション科学基礎研究所 (略称: NTT)
NTT Communication Sciene Laboratories, NTT Corporation (略称: NTT) |
| 第3著者 氏名(和/英/ヨミ) |
中村 篤 / Atsushi Nakamura / ナカムラ アツシ |
| 第3著者 所属(和/英) |
日本電信電話株式会社 NTTコミュニケーション科学基礎研究所 (略称: NTT)
NTT Communication Sciene Laboratories, NTT Corporation (略称: NTT) |
| 第4著者 氏名(和/英/ヨミ) |
/ / |
| 第4著者 所属(和/英) |
(略称: )
(略称: ) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2008-07-18 10:50:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2008-54 |
| 巻番号(vol) |
vol.108 |
| 号番号(no) |
no.142 |
| ページ範囲 |
pp.67-72 |
| ページ数 |
6 |
| 発行日 |
2008-07-10 (SP) |
|