| 講演抄録/キーワード |
| 講演名 |
孤立音[あ]を聞いて音韻/あ/と同定する能力は音声言語に必要か? ○峯松信明・西村多寿子(東大)・櫻庭京子(清瀬福祉センタ)・朝川 智・齋藤大輔(東大) SP2007-30 |
| 抄録 |
(和) |
一つの言語には通常数十種類の音素(phoneme)がある。しかし音素の音的実体は前後文脈(音素環境)などによって多様に変形し,異音(allophone)と呼ばれる。音素と比較して種類数も多く,より具体的な音的現象に対応している。しかし\.奇\.妙\.な\.こ\.と\.に,これら音的事象を記号を用いて記す場合,性別,年齢,収録・伝送機器特性などによる音の変形(非言語的要因による音響的変形)は一切無視される。その音響的変形が幾ら大きくても,である。音声認識の音響モデリングは,凡そ,異音に相当する音事象を triphone としてモデル化しているが,「非言語的変形の無視」を実装するために,数万人の話者から,様々な環境で収録した音サンプル群を統計的にモデル化している。本稿では,「非言語的変形の無視」の実装は,集めることではなく,音事象間の差異を捉えることで可能となることを数学的に示し,極めて少数の話者の音声で,不特定話者音声認識が可能であることを示す。提案する枠組みでは,音的要素をモデル化するのではなく,音的差異に着眼し,差異を集めることで構成される全体的な音的構造をモデル化する。 |
| (英) |
A language generally has several tens of phonemes. Acoustic substances of the phoneme depend upon its phonemic environment and the context-sensitive phonemes are called allophones. The number of the allophones in a language is naturally much larger than that of the phonemes. Although the allophones represent finer acoustic differences between linguistic sounds, it is very strange that they completely ignore the acoustic variations in an allophone caused by differences in age, gender, microphone, room, etc. The triphones, which are acoustic models widely used in speech recognition, correspond to the allophones and the ignorance of the acoustic variations caused by the non-linguistic factors are implemented by collecting speech samples from an enormous number of speakers and training statistical acoustic models of the individual allophones. In this paper, it is mathematically shown that the ignorance can be realized not by collecting samples but by capturing timbral differences between two sounds. Then, the possibility of speaker-independent speech recognition only with a very small number of training speakers is experimentally examined. In the proposed framework, what is modeled is not the elementary sound substances, i.e., reductionism, but the holistic sound system exclusively composed of the timbral differences, i.e., holism. |
| キーワード |
(和) |
変換不変 / 音色差異 / 相対音感 / 音声模倣 / 言語障害 / / / |
| (英) |
transform-invariance / timbral difference / relative sense of sounds / vocal imitation / language disorder / / / |
| 文献情報 |
信学技報, vol. 107, no. 165, SP2007-30, pp. 37-42, 2007年7月. |
| 資料番号 |
SP2007-30 |
| 発行日 |
|
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
SP2007-30 |
| 研究会情報 |
| 研究会 |
SP |
| 開催期間 |
2007-07-26 - 2007-07-27 |
| 開催地(和) |
富山県立大 |
| 開催地(英) |
Toyama Prefectural University |
| テーマ(和) |
音声生成,知覚,聴覚・音声,一般 |
| テーマ(英) |
Speech Production, Speech Perception, Hearing and Speech, etc. |
| 講演論文情報の詳細 |
| 申込み研究会 |
SP |
| 会議コード |
2007-07-SP |
| 本文の言語 |
日本語 |
| タイトル(和) |
孤立音[あ]を聞いて音韻/あ/と同定する能力は音声言語に必要か? |
| サブタイトル(和) |
|
| タイトル(英) |
Is the ability of identifying a given [a] sound as phoneme /a/ necessary for spoken language competence? |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
変換不変 / transform-invariance |
| キーワード(2)(和/英) |
音色差異 / timbral difference |
| キーワード(3)(和/英) |
相対音感 / relative sense of sounds |
| キーワード(4)(和/英) |
音声模倣 / vocal imitation |
| キーワード(5)(和/英) |
言語障害 / language disorder |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
峯松 信明 / Nobuaki Minematsu / ミネマツ ノブアキ |
| 第1著者 所属(和/英) |
東京大学 (略称: 東大)
The University of Tokyo (略称: Univ. of Tokyo) |
| 第2著者 氏名(和/英/ヨミ) |
西村 多寿子 / Tazuko Nishimura / ニシムラ タズコ |
| 第2著者 所属(和/英) |
東京大学 (略称: 東大)
The University of Tokyo (略称: Univ. of Tokyo) |
| 第3著者 氏名(和/英/ヨミ) |
櫻庭 京子 / Kyoko Sakuraba / サクラバ キョウコ |
| 第3著者 所属(和/英) |
清瀬市障害者福祉センタ (略称: 清瀬福祉センタ)
Kiyose-shi Welfare Center for the Handicapped (略称: Kiyose Welfare Center) |
| 第4著者 氏名(和/英/ヨミ) |
朝川 智 / Satoshi Asakawa / アサカワ サトシ |
| 第4著者 所属(和/英) |
東京大学 (略称: 東大)
The University of Tokyo (略称: Univ. of Tokyo) |
| 第5著者 氏名(和/英/ヨミ) |
齋藤 大輔 / Daisuke Saito / サイトウ ダイスケ |
| 第5著者 所属(和/英) |
東京大学 (略称: 東大)
The University of Tokyo (略称: Univ. of Tokyo) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
|
| 発表時間 |
分 |
| 申込先研究会 |
SP |
| 資料番号 |
SP2007-30 |
| 巻番号(vol) |
vol.107 |
| 号番号(no) |
no.165 |
| ページ範囲 |
pp.37-42 |
| ページ数 |
6 |
| 発行日 |
|
|