| 講演抄録/キーワード |
| 講演名 |
2009-09-11 09:30
発話理解における視覚情報の役割 ○伊東和廣(千葉工大)・望月 要(帝京大)・大西 仁(放送大)・中村直人(千葉工大) CQ2009-34 |
| 抄録 |
(和) |
人間は音声言語を使ってコミュニケーションする場合でも,相手の表情から様々な情報を読み取り,それによって音声情報を補うことでコミュニケーションを円滑にしている.特に音声の補完を行う場合には,話者の口唇の動きから聴覚だけで聞き取れなかった情報を補っていると考えられる.本稿は,発話内容の聞き取りにおける,発話者の顔面の視覚情報の役割を実験的に検証したものである.実験では,短文を発話する映像を用いて,「音声のみ」を聞いた場合と「音声+顔映像」を提示した場合とで音声聞き取りの正確さの比較を行った.この時,音量の異なるノイズを音声に重ね合わせることで,聞き取りの難易度と,顔映像の聞き取り貢献の関係を探った.同時に,被験者の視線の動きをアイマークレコーダで計測し,視線の動きと音声補完との関係を調べた.その結果,ノイズを付加しない場合には,顔映像を提示しても音声の聞き取り率は向上せず,被験者は発話者の目元を注視する傾向が認められたのに対し,ノイズがある場合には,顔映像を提示することで音声の聞き取り率が向上し,被験者は発話者の口元を注視することが多いことが明らかにった.このことは,音声言語を主体とするコミュニケーションにおいても,音声情報が劣化した場合には,視覚情報を利用して音声を補完していることを示している. |
| (英) |
When we talk with somebody, not only the voice of speaker but also his or her facial expressions play an important role in mutual understanding. This report examined the contribution of visual information of speaker’s face to speech cognition. In our experiment, participants were presented two types of materials: (1) voice only, (2) motion picture of speaker with voice and face under four different levels of background noise conditions and were asked to repeat precisely what speaker said. The results showed that accuracy of repeat was same or higher in the voice only material than motion picture when materials were presented without noise. But when the noise added, accuracy was higher in motion picture. The analysis of gaze tracking data showed that participants tended to look at speaker’s eyes when the motion picture presented without noise, but they looked at speaker’s mouth when noise added. These results clearly show the contribution of the visual information of speaker’s face to speech cognition. |
| キーワード |
(和) |
視聴覚統合 / 発話理解 / 視線計測 / / / / / |
| (英) |
Audio-visual integration / Speech recognition / Gaze tracking / / / / / |
| 文献情報 |
信学技報, vol. 109, no. 191, CQ2009-34, pp. 49-52, 2009年9月. |
| 資料番号 |
CQ2009-34 |
| 発行日 |
2009-09-03 (CQ) |
| ISSN |
Print edition: ISSN 0913-5685 Online edition: ISSN 2432-6380 |
著作権に ついて |
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034) |
| PDFダウンロード |
CQ2009-34 |
| 研究会情報 |
| 研究会 |
CQ |
| 開催期間 |
2009-09-10 - 2009-09-11 |
| 開催地(和) |
高山市民文化会館 |
| 開催地(英) |
Takayama Culture Center |
| テーマ(和) |
五感メディア,映像/音声サービスの品質,ネットワークの品質・QoS制御,次世代ネットワークアーキテクチャ,仮想空間におけるユーザコミュニケーション,一般 |
| テーマ(英) |
Quality of multi-sensory media, Audio and video quality, Quality control of networks, Architecture of Next/New generation networks, Communications in virtual environments, general fields |
| 講演論文情報の詳細 |
| 申込み研究会 |
CQ |
| 会議コード |
2009-09-CQ |
| 本文の言語 |
日本語 |
| タイトル(和) |
発話理解における視覚情報の役割 |
| サブタイトル(和) |
|
| タイトル(英) |
Contribution of Visual Information to Speech Cognition |
| サブタイトル(英) |
|
| キーワード(1)(和/英) |
視聴覚統合 / Audio-visual integration |
| キーワード(2)(和/英) |
発話理解 / Speech recognition |
| キーワード(3)(和/英) |
視線計測 / Gaze tracking |
| キーワード(4)(和/英) |
/ |
| キーワード(5)(和/英) |
/ |
| キーワード(6)(和/英) |
/ |
| キーワード(7)(和/英) |
/ |
| キーワード(8)(和/英) |
/ |
| 第1著者 氏名(和/英/ヨミ) |
伊東 和廣 / Kazuhiro Ito / イトウ カズヒロ |
| 第1著者 所属(和/英) |
千葉工業大学 (略称: 千葉工大)
Chiba Institude of Technology (略称: Chiba Inst. of Tech) |
| 第2著者 氏名(和/英/ヨミ) |
望月 要 / Kaname Mochizuki / モチヅキ カナメ |
| 第2著者 所属(和/英) |
帝京大学 (略称: 帝京大)
Teikyo University (略称: Teikyo Univ.) |
| 第3著者 氏名(和/英/ヨミ) |
大西 仁 / Hitoshi Ohnishi / オオニシ ヒトシ |
| 第3著者 所属(和/英) |
放送大学 (略称: 放送大)
The Open University of Japan (略称: The Open Univ. of Japan) |
| 第4著者 氏名(和/英/ヨミ) |
中村 直人 / Naoto Nakamura / ナカムラ ナオト |
| 第4著者 所属(和/英) |
千葉工業大学 (略称: 千葉工大)
Chiba Institude of Technology (略称: Chiba Inst. of Tech) |
| 第5著者 氏名(和/英/ヨミ) |
/ / |
| 第5著者 所属(和/英) |
(略称: )
(略称: ) |
| 第6著者 氏名(和/英/ヨミ) |
/ / |
| 第6著者 所属(和/英) |
(略称: )
(略称: ) |
| 第7著者 氏名(和/英/ヨミ) |
/ / |
| 第7著者 所属(和/英) |
(略称: )
(略称: ) |
| 第8著者 氏名(和/英/ヨミ) |
/ / |
| 第8著者 所属(和/英) |
(略称: )
(略称: ) |
| 第9著者 氏名(和/英/ヨミ) |
/ / |
| 第9著者 所属(和/英) |
(略称: )
(略称: ) |
| 第10著者 氏名(和/英/ヨミ) |
/ / |
| 第10著者 所属(和/英) |
(略称: )
(略称: ) |
| 第11著者 氏名(和/英/ヨミ) |
/ / |
| 第11著者 所属(和/英) |
(略称: )
(略称: ) |
| 第12著者 氏名(和/英/ヨミ) |
/ / |
| 第12著者 所属(和/英) |
(略称: )
(略称: ) |
| 第13著者 氏名(和/英/ヨミ) |
/ / |
| 第13著者 所属(和/英) |
(略称: )
(略称: ) |
| 第14著者 氏名(和/英/ヨミ) |
/ / |
| 第14著者 所属(和/英) |
(略称: )
(略称: ) |
| 第15著者 氏名(和/英/ヨミ) |
/ / |
| 第15著者 所属(和/英) |
(略称: )
(略称: ) |
| 第16著者 氏名(和/英/ヨミ) |
/ / |
| 第16著者 所属(和/英) |
(略称: )
(略称: ) |
| 第17著者 氏名(和/英/ヨミ) |
/ / |
| 第17著者 所属(和/英) |
(略称: )
(略称: ) |
| 第18著者 氏名(和/英/ヨミ) |
/ / |
| 第18著者 所属(和/英) |
(略称: )
(略称: ) |
| 第19著者 氏名(和/英/ヨミ) |
/ / |
| 第19著者 所属(和/英) |
(略称: )
(略称: ) |
| 第20著者 氏名(和/英/ヨミ) |
/ / |
| 第20著者 所属(和/英) |
(略称: )
(略称: ) |
| 第21著者 氏名(和/英/ヨミ) |
/ / |
| 第21著者 所属(和/英) |
(略称: )
(略称: ) |
| 第22著者 氏名(和/英/ヨミ) |
/ / |
| 第22著者 所属(和/英) |
(略称: )
(略称: ) |
| 第23著者 氏名(和/英/ヨミ) |
/ / |
| 第23著者 所属(和/英) |
(略称: )
(略称: ) |
| 第24著者 氏名(和/英/ヨミ) |
/ / |
| 第24著者 所属(和/英) |
(略称: )
(略称: ) |
| 第25著者 氏名(和/英/ヨミ) |
/ / |
| 第25著者 所属(和/英) |
(略称: )
(略称: ) |
| 第26著者 氏名(和/英/ヨミ) |
/ / |
| 第26著者 所属(和/英) |
(略称: )
(略称: ) |
| 第27著者 氏名(和/英/ヨミ) |
/ / |
| 第27著者 所属(和/英) |
(略称: )
(略称: ) |
| 第28著者 氏名(和/英/ヨミ) |
/ / |
| 第28著者 所属(和/英) |
(略称: )
(略称: ) |
| 第29著者 氏名(和/英/ヨミ) |
/ / |
| 第29著者 所属(和/英) |
(略称: )
(略称: ) |
| 第30著者 氏名(和/英/ヨミ) |
/ / |
| 第30著者 所属(和/英) |
(略称: )
(略称: ) |
| 第31著者 氏名(和/英/ヨミ) |
/ / |
| 第31著者 所属(和/英) |
(略称: )
(略称: ) |
| 第32著者 氏名(和/英/ヨミ) |
/ / |
| 第32著者 所属(和/英) |
(略称: )
(略称: ) |
| 第33著者 氏名(和/英/ヨミ) |
/ / |
| 第33著者 所属(和/英) |
(略称: )
(略称: ) |
| 第34著者 氏名(和/英/ヨミ) |
/ / |
| 第34著者 所属(和/英) |
(略称: )
(略称: ) |
| 第35著者 氏名(和/英/ヨミ) |
/ / |
| 第35著者 所属(和/英) |
(略称: )
(略称: ) |
| 第36著者 氏名(和/英/ヨミ) |
/ / |
| 第36著者 所属(和/英) |
(略称: )
(略称: ) |
| 講演者 |
第1著者 |
| 発表日時 |
2009-09-11 09:30:00 |
| 発表時間 |
30分 |
| 申込先研究会 |
CQ |
| 資料番号 |
CQ2009-34 |
| 巻番号(vol) |
vol.109 |
| 号番号(no) |
no.191 |
| ページ範囲 |
pp.49-52 |
| ページ数 |
4 |
| 発行日 |
2009-09-03 (CQ) |
|