ご案内 入会して研究会活動をもっとお得に!研究会参加費・年間登録費が会員価格になります。
お知らせ 【重要】研究会参加費の支払いおよび原稿アップロード手続きの変更に関するご案内
電子情報通信学会 研究会発表申込システム
講演論文 詳細
技報閲覧サービス
[ログイン]
技報アーカイブ
 トップに戻る 前のページに戻る   [Japanese] / [English] 

講演抄録/キーワード
講演名 2008-03-28 10:50
MPIによる並列計算を用いたマルチエージェント強化学習のカオス制御への適用
佐藤倫久安達雅春東京電機大NLP2007-169
抄録 (和) 強化学習は試行錯誤的学習アルゴリズムであり,明示的な教師信号を与えずに学習者が行った行動の評価のみを用いる学習法である.そのため望ましい行動を行えるようようになるまでの学習時間が非常に多い。そこで複数のエージェントが同時に学習し,効率よく学習を行えるマルチエージェント強化学習が提案されている.本研究では,共通の記憶を持つマルチエージェント強化学習をMPIによって実現し,カオス制御に適用した.その結果,シングルエージェント強化学習より短時間で同等の性能を示すことがわかった.また,複数回学習を繰り返しても同一の行動を選ぶ量子化状態は,カオス制御において重要な位置に対応する量子化状態である可能性が高いことを示唆する結果を得た 
(英) A reinforcement learning is a trial and error process, therefore it takes a huge computation time. It multiple agents can learn simultaneously the computational time can be reduced. In this paper we attempt to apply a multi-agent reinforcement learning to chaos control. We implement a multi-agent reinforcement learning using Message-Passing Interface. We compared the control performance of the multi-agent reinforcement learning and that of a single agent reinforcement learning. As a result, the multi-agent reinforcement learning show almost the same performance with the single-agent one. Even if learning iterate for a many times. Moreover, it is suggested that the quantized states whose action after learning by the multi-agent are the same, are important locations for the chaos control.
キーワード (和) カオスの制御 / 強化学習 / MPI / / / / /  
(英) control of chaos / reinforcement lerning / MPI(Message-Passing Interface) / / / / /  
文献情報 信学技報, vol. 107, no. 561, NLP2007-169, pp. 13-18, 2008年3月.
資料番号 NLP2007-169 
発行日 2008-03-21 (NLP) 
ISSN Print edition: ISSN 0913-5685    Online edition: ISSN 2432-6380
著作権に
ついて
技術研究報告に掲載された論文の著作権は電子情報通信学会に帰属します.(許諾番号:10GA0019/12GB0052/13GB0056/17GB0034/18GB0034)
PDFダウンロード NLP2007-169

研究会情報
研究会 NLP  
開催期間 2008-03-27 - 2008-03-28 
開催地(和) 神戸大学 
開催地(英)  
テーマ(和) 一般 
テーマ(英)  
講演論文情報の詳細
申込み研究会 NLP 
会議コード 2008-03-NLP 
本文の言語 日本語 
タイトル(和) MPIによる並列計算を用いたマルチエージェント強化学習のカオス制御への適用 
サブタイトル(和)  
タイトル(英) A multi-agent Reinforcement Learning with Parallel Computation and its Application to Chaos Control 
サブタイトル(英)  
キーワード(1)(和/英) カオスの制御 / control of chaos  
キーワード(2)(和/英) 強化学習 / reinforcement lerning  
キーワード(3)(和/英) MPI / MPI(Message-Passing Interface)  
キーワード(4)(和/英) /  
キーワード(5)(和/英) /  
キーワード(6)(和/英) /  
キーワード(7)(和/英) /  
キーワード(8)(和/英) /  
第1著者 氏名(和/英/ヨミ) 佐藤 倫久 / Norihisa Sato / サトウ ノリヒサ
第1著者 所属(和/英) 東京電機大学 (略称: 東京電機大)
Tokyo Denki University (略称: Tokyo Denki Univ.)
第2著者 氏名(和/英/ヨミ) 安達 雅春 / Masaharu Adachi / アダチ マサハル
第2著者 所属(和/英) 東京電機大学 (略称: 東京電機大)
Tokyo Denki University (略称: Tokyo Denki Univ.)
第3著者 氏名(和/英/ヨミ) / /
第3著者 所属(和/英) (略称: )
(略称: )
第4著者 氏名(和/英/ヨミ) / /
第4著者 所属(和/英) (略称: )
(略称: )
第5著者 氏名(和/英/ヨミ) / /
第5著者 所属(和/英) (略称: )
(略称: )
第6著者 氏名(和/英/ヨミ) / /
第6著者 所属(和/英) (略称: )
(略称: )
第7著者 氏名(和/英/ヨミ) / /
第7著者 所属(和/英) (略称: )
(略称: )
第8著者 氏名(和/英/ヨミ) / /
第8著者 所属(和/英) (略称: )
(略称: )
第9著者 氏名(和/英/ヨミ) / /
第9著者 所属(和/英) (略称: )
(略称: )
第10著者 氏名(和/英/ヨミ) / /
第10著者 所属(和/英) (略称: )
(略称: )
第11著者 氏名(和/英/ヨミ) / /
第11著者 所属(和/英) (略称: )
(略称: )
第12著者 氏名(和/英/ヨミ) / /
第12著者 所属(和/英) (略称: )
(略称: )
第13著者 氏名(和/英/ヨミ) / /
第13著者 所属(和/英) (略称: )
(略称: )
第14著者 氏名(和/英/ヨミ) / /
第14著者 所属(和/英) (略称: )
(略称: )
第15著者 氏名(和/英/ヨミ) / /
第15著者 所属(和/英) (略称: )
(略称: )
第16著者 氏名(和/英/ヨミ) / /
第16著者 所属(和/英) (略称: )
(略称: )
第17著者 氏名(和/英/ヨミ) / /
第17著者 所属(和/英) (略称: )
(略称: )
第18著者 氏名(和/英/ヨミ) / /
第18著者 所属(和/英) (略称: )
(略称: )
第19著者 氏名(和/英/ヨミ) / /
第19著者 所属(和/英) (略称: )
(略称: )
第20著者 氏名(和/英/ヨミ) / /
第20著者 所属(和/英) (略称: )
(略称: )
第21著者 氏名(和/英/ヨミ) / /
第21著者 所属(和/英) (略称: )
(略称: )
第22著者 氏名(和/英/ヨミ) / /
第22著者 所属(和/英) (略称: )
(略称: )
第23著者 氏名(和/英/ヨミ) / /
第23著者 所属(和/英) (略称: )
(略称: )
第24著者 氏名(和/英/ヨミ) / /
第24著者 所属(和/英) (略称: )
(略称: )
第25著者 氏名(和/英/ヨミ) / /
第25著者 所属(和/英) (略称: )
(略称: )
第26著者 氏名(和/英/ヨミ) / /
第26著者 所属(和/英) (略称: )
(略称: )
第27著者 氏名(和/英/ヨミ) / /
第27著者 所属(和/英) (略称: )
(略称: )
第28著者 氏名(和/英/ヨミ) / /
第28著者 所属(和/英) (略称: )
(略称: )
第29著者 氏名(和/英/ヨミ) / /
第29著者 所属(和/英) (略称: )
(略称: )
第30著者 氏名(和/英/ヨミ) / /
第30著者 所属(和/英) (略称: )
(略称: )
第31著者 氏名(和/英/ヨミ) / /
第31著者 所属(和/英) (略称: )
(略称: )
第32著者 氏名(和/英/ヨミ) / /
第32著者 所属(和/英) (略称: )
(略称: )
第33著者 氏名(和/英/ヨミ) / /
第33著者 所属(和/英) (略称: )
(略称: )
第34著者 氏名(和/英/ヨミ) / /
第34著者 所属(和/英) (略称: )
(略称: )
第35著者 氏名(和/英/ヨミ) / /
第35著者 所属(和/英) (略称: )
(略称: )
第36著者 氏名(和/英/ヨミ) / /
第36著者 所属(和/英) (略称: )
(略称: )
講演者 第1著者 
発表日時 2008-03-28 10:50:00 
発表時間 25分 
申込先研究会 NLP 
資料番号 NLP2007-169 
巻番号(vol) vol.107 
号番号(no) no.561 
ページ範囲 pp.13-18 
ページ数
発行日 2008-03-21 (NLP) 


[研究会発表申込システムのトップページに戻る]

[電子情報通信学会ホームページ]


IEICE / 電子情報通信学会