マルチエージェント系における方策勾配法 : 追跡問題
スポンサーリンク
概要
- 論文の詳細を見る
マルチエージェント系における行動学習法として方策勾配法を用いる強化学習方式を提案する.本方式では,自律分散的な行動方式を採用することにより,マルチエージェント系の行動決定問題を各エージェント内で定義されたある目的関数の最小化問題に帰着させる.目的関数は,状態の価値,状態・行動ルール,ポテンシャル等の項によって表現することができる.本方式による学習則は,これらの項に含まれるパラメータを,ボルツマン分布による確率的方策から得られる系の行動計画に対する評価関数の期待値が最大となるよう確率的勾配法によって更新するものである.本方式の適用例として,追跡問題に対する実験の結果を合わせて報告する.実験の結果,本方式によって良好な方策が得られることを確認した.さらに,本方式は,方策中への行動制約や目的の変更追加,ヒューリスティクスの利用に柔軟に対応できることを示した.
- 2003-01-29
著者
関連論文
- 非マルコフ決定過程における強化学習 : 特徴的適正度の統計的性質(モデル/理論,ソフトウェアエージェントとその応用論文)
- 非マルコフ決定過程における方策勾配法の一考察 : カーリングの事例
- Ridgelet-Hough変換を用いた足跡画像符号化に関する考察 : 符号化方法の提案および従来法との特徴比較(プロセッサ, DSP, 画像処理技術及び一般)
- Ridgelet-Hough変換を用いた足跡画像符号化に関する考察--符号化方法の提案および従来法との特徴比較
- 1D-6 方策勾配法を用いたサッカーエージェントの学習 : パス・レシーブ(ゲーム・ロボカップ,一般セッション,人工知能と認知科学)
- 2P1-S-022 方策勾配法を用いたフリーキック時の行動学習(ロボカップ2,生活を支援するロボメカ技術のメガインテグレーション)
- Ridgelet-Hough変換を用いた足跡画像符号化に関する考察 : 符号化方法の提案および従来法との特徴比較(プロセッサ, DSP, 画像処理技術及び一般)
- Ridgelet-Hough変換を用いた足跡画像符号化に関する考察 : 符号化方法の提案および従来法との特徴比較(プロセッサ, DSP, 画像処理技術及び一般)
- 1A1-N-028 方策勾配法を用いた運動方程式中のパラメータ学習 : 2ストーン系のカーリングゲーム(マルチエージェントロボットシステム,生活を支援するロボメカ技術のメガインテグレーション)
- Ridgelet-Hough変換を用いた足跡画像符号化に関する考察 : 符号化方法の提案および従来法との特徴比較(プロセッサ, DSP, 画像処理技術及び一般)
- 離散最適化問題としての自律移動型ロボットの走行誘導
- 方策こう配法を用いた行動学習 : 環境のダイナミクスと行動知識との分離
- マルチエージェント系における行動学習への方策こう配法の適用 : 追跡問題(分散協調とエージェント)
- マルチエージェント系における方策勾配法 : 追跡問題
- マルチエージェント系における方策勾配法 : 追跡問題
- 強化学習を用いた自律移動型ロボットの行動計画法の提案
- 方策勾配法における目的関数の合成と追跡問題への適用 (テーマ:知能・適応と社会,ネットワーク) -- (マルチエージェントシステム)
- F_004 方策こう配法を用いた行動学習 : 方策中での状態遷移確率の表現(F分野:人工知能・ゲーム)
- 入力パターンベクトルの分布に基づくクラス分類問題の分割法
- 方策勾配法を用いた自律移動型ロボットの行動計画法
- ノードコストを考慮した最短経路探索法とデータ構造
- ノードコストを考慮した最短経路探索法とデータ構造
- 離散最適化問題としての自律移動型ロボットの経路計画
- 状態の複数の抽象化による方策こう配法の高速化--トンネル状の障害物が存在する追跡問題への適用
- 状態の複数の抽象化による方策こう配法の高速化 : トンネル状の障害物が存在する追跡問題への適用(情報ネットワーク)
- 動径基底関数を用いたクラス分類問題の分割法 : モジュール型ニューラルネットワークへの適用
- マルチエージェントシステムにおける行動制御 : PSOにおける重み係数の強化学習(情報ネットワーク)
- ファジィ制御ルールにより表現された方策を持つ方策勾配法の導出
- 方策勾配法による局面評価関数とシミュレーション方策の学習