マクロデータフロー処理における処理とデータ転送のオーバーラップ
スポンサーリンク
概要
- 論文の詳細を見る
マルチプロセッサシステム上でのFORTRANプログラムの並列処理手法として、ループやサブルーチン等の粗粒度タスク間の並列性を利用する粗粒度並列処理 (マクロデータフロー処理)、ループのイタレーション間の並列性を利用する中粒度並列処理 (ループ並列化)、ステートメントレベルの近細粒度並列処理 、さらにそれらを階層的に組み合わせたマルチグレイン並列処理手法が提案されている。マクロデータフロー処理においては、ローカルメモリ経由でマクロタスク間のデータ授受を行なう方法 (データローカライゼーション手法) が提案されている。しかし、このようにプロセッサ間データ転送を最小化しても、必要なデータ転送が残る。また、多くの計算機ではデータ転送を CPUの代わりに行なうデータ転送ユニットを各プロセッサエレメントに持たせ、CPUの処埋と平行してデータ転送を行なえるようになっていて、見かけ上のデータ転送オーバーヘッドを隠蔽することが可能である。しかしながら、ユーザが処理とデータ転送のオーバーラップを考慮したプログラミングを行なうことは困難である。本稿では、マクロデータフロー処理において、処理とデータ転送を効率的にオーバーラップさせデータ転送オーバーヘッドを削減するための、マクロデータフロー処理におけるデータプレロード手法を提案する。本手法を適用することにより、対象マクロタスクの割り当てを待たずにデータロードが行なえるようになり、処理とデータ転送を効率的にオーバーラップさせることが可能となる。
- 一般社団法人情報処理学会の論文
- 1997-03-12
著者
-
橋本 茂
早稲田大学理工学部電気電子情報工学科
-
岡本 雅巳
早稲田大学理工学部
-
笠原 博徳
早稲田大学
-
藤本 謙作
早稲田大学理工学部電気電子情報工学科
-
藤本 謙作
早稲田大学理工学部電子電気情報工学科
関連論文
- 並列度・タスク実行時間の偏りを考慮した標準タスクグラフセットSTG Ver3を用いたスケジューリングアルゴリズムの評価(並列/分散アーキテクチャ,「ハイパフォーマンスコンピューティングとアーキテクチャの評価」に関する北海道ワークショップ(HOKKE-2009))
- 並列度・タスク実行時間の偏りを考慮した標準タスクグラフセットSTG Ver3を用いたスケジューリングアルゴリズムの評価(並列/分散アーキテクチャ,「ハイパフォーマンスコンピューティングとアーキテクチャの評価」に関する北海道ワークショップ(HOKKE-2009))
- メディアアプリケーションを用いた並列化コンパイラ協調型ヘテロジニアスマルチコアアーキテクチャのシミュレーション評価(組込みシステムプラットフォーム)
- メディアアプリケーションを用いた並列化コンパイラ協調型ヘテロジニアスマルチコアアーキテクチャのシミュレーション評価(組込みシステムプラットフォーム)
- メディアアプリケーションを用いた並列化コンパイラ協調型ヘテロジニアスマルチコアアーキテクチャのシミュレーション評価(組込みシステムプラットフォーム)
- マルチコア上でのOSCAR APIを用いた低消費電力化手法(組込みシステムプラットフォーム)
- 54倍速AACエンコードを実現するヘテロジニアスマルチコアアーキテクチャの検討(マルチコア,プロセッサ,VLSI回路,デバイス技術(高速,低電圧,低消費電力))
- 54倍速AACエンコードを実現するヘテロジニアスマルチコアアーキテクチャの検討(マルチコア,プロセッサ, VLSI回路,デバイス技術(高速,低電圧,低消費電力))
- マルチコアプロセッサ上での粗粒度タスク並列処理におけるデータ転送オーバラップ(通信と同期,「ハイパフォーマンスコンピューティングとアーキテクチャの評価」に関する北海道ワークショップ(HOKKE-2006))
- マルチコアプロセッサ上での粗粒度タスク並列処理におけるデータ転送オーバラップ(通信と同期, 「ハイパフォーマンスコンピューティングとアーキテクチャの評価」に関する北海道ワークショップ(HOKKE-2006))
- OSCARチップマルチプロセッサ上でのマルチグレイン並列性評価(ARC-4 : 実行スケジューリング)(2004年並列/分散/協調処理に関する『青森』サマー・ワークショップ(SWoPP青森2004) : 研究会・連続同時開催)
- マルチグレイン並列性向上のための選択的インライン展開手法(並列・分散処理技術)
- マルチグレイン並列性向上のためのインライン展開手法
- OSCARチップマルチプロセッサ上でのマルチグレイン並列処理
- 並列処理階層自動決定手法を用いた粗粒度タスク並列処理
- (2)パネル討論 : アーキテクチャ研究の将来(150回研究会記念特別企画)
- 150回研究会記念特別企画(2)パネル討論 : アーキテクチャ研究の将来
- マルチコアプロセッサにおけるコンパイラ制御低消費電力化手法(プロセッサアーキテクチャ)
- シングルチップマルチプロセッサ上での近細粒度並列処理 (並列処理)
- シングルチップマルチプロセッサ上でのマルチグレイン並列処理
- マルチコアのためのコンパイラにおけるローカルメモリ管理手法(組込みシステムプラットフォーム)
- ヘテロジニアスマルチコア上でのコンパイラによる低消費電力制御(ARC-6 : ソフトウェア最適化,2007年並列/分散/協調処理に関する『旭川』サマー・ワークショップ(SWoPP旭川2007))
- ヘテロジニアスチップマルチプロセッサにおける粗粒度タスクスタティックスケジューリング手法(並列処理手法, SHINING 2006 「アーキテクチャとコンパイラの協調および一般」)
- ホモジニアスマルチコアにおけるコンパイラ制御低消費電力化手法(ARC-4: 低電力アーキテクチャ2, 2005年並列/分散/協調処理に関する『武雄』サマー・ワークショップ(SWoPP武雄2005)-研究会・連続同時開催-)
- ヘテロジニアスマルチコア上での階層的粗粒度タスクスタティックスケジューリング手法(ARC-6 : ソフトウェア最適化,2007年並列/分散/協調処理に関する『旭川』サマー・ワークショップ(SWoPP旭川2007))
- マルチコアプロセッサ上でのマルチメディア処理の並列化(マルチプロセッサ)
- 独立に周波数制御可能な4320MIPS、SMP/AMP対応4プロセッサLSIの開発(集積回路とアーキテクチャの協創-プロセッサ,メモリ,システムLSI及び一般-)
- 情報家電用マルチコアSMP実行モードにおけるマルチグレイン並列処理(集積回路とアーキテクチャの協創-プロセッサ,メモリ,システムLSI及び一般-)
- 独立に周波数制御可能な4320MIPS、SMP/AMP対応4プロセッサLSIの開発(マルチコア,集積回路とアーキテクチャの協創-プロセッサ,メモリ,システムLSI及び一般-)
- 情報家電用マルチコアSMP実行モードにおけるマルチグレイン並列処理(マルチコア,集積回路とアーキテクチャの協創-プロセッサ,メモリ,システムLSI及び一般-)
- マルチコア上でのマルチメディアアプリケーションの自動並列化(マルチコア)
- OSCARコンパイラにおける制約付きCプログラムの自動並列化(並列化コンパイラ)
- ポインタ解析を用いた制約付きCプログラムの自動並列化(並列処理,集積回路とアーキテクチャの協創〜どう繋ぐ?どう使う?マルチコア〜)
- 階層グルーピング対応バリア同期機構の評価(マイクロアーキテクチャ,集積回路とアーキテクチャの協創〜どう繋ぐ?どう使う?マルチコア〜)
- 自動並列化のためのElement-Sensitiveポインタ解析
- Fortran マルチグレイン並列処理におけるデータローカライゼーション手法
- Fortran粗粒度並列処理におけるDoall/シーケンシャルループ間データローカライゼーション手法
- 粗粒度並列処理におけるDoall/シーケンシャルループ間データローカライゼーション手法
- Fortran マクロデータフロー処理におけるデータローカライゼーション手法
- マルチグレイン並列処理におけるタスク融合を用いたデータローカライゼーション手法
- マクロデータフロー処理におけるデータローカライゼーション手法
- Fortranマクロデータフロー処理におけるデータローカライゼーション
- H.264/AVCエンコーダのマルチコアプロセッサにおける階層的並列処理
- H.264/AVCエンコーダのマルチコアプロセッサにおける階層的並列処理
- OSCAR API標準解釈系を用いたParallelizable Cプログラムの評価
- 情報家電用ヘテロジニアスマルチコアRP-Xにおけるコンパイラ低消費電力制御性能
- 組込み向けマルチコア上での複数アプリケーション動作時の自動並列化されたアプリケーションの処理性能
- マルチコア上でのOSCAR APIを用いた並列化コンパイラによる低消費電力化手法
- 近細粒度並列処理用シングルチップマルチプロセッサにおけるプロセッサコアの評価
- 2000-ARC-139-16 近細粒度並列処理用シングルチップマルチプロセッサにおけるプロセッサコアの構成
- 情報家電用マルチコア並列化APIを生成する自動並列化コンパイラによる並列化の評価
- 情報家電用ヘテロジニアスマルチコア用自動並列化コンパイラフレームワーク
- 自動並列化技術を用いたメディア処理オフロード
- 自動並列化技術を用いたメディア処理オフロード
- 自動並列化技術を用いたメディア処理オフロード
- 自動並列化技術を用いたメディア処理オフロード
- 並列化コンパイラによるソフトウェアコヒーレンシ制御
- 並列化コンパイラによるソフトウェアコヒーレンシ制御
- プログラム構造に着目したメニーコアアーキテクチャシミュレータの高速化手法
- マルチコアのためのコンパイラにおけるローカルメモリ管理手法(組込みシステムプラットフォーム)
- マルチコア上でのOSCAR APIを用いた低消費電力化手法(組込みシステムプラットフォーム)
- マルチコアのためのコンパイラにおけるローカルメモリ管理手法(組込みシステムプラットフォーム)
- マルチコア上でのOSCAR APIを用いた低消費電力化手法(組込みシステムプラットフォーム)
- スタティックスケジューリングを用いた電子回路シミュレーションの粗粒度/近細粒度階層型並列処理手法
- 電力系統過渡安定度計算の階層的並列処理手法
- 電子回路シミュレーションの階層的並列処理手法
- 電子回路シミュレーションの階層的並列処理手法
- 電子回路シミュレーションの粗粒度/近細粒度階層的並列手法
- マルチグレイン並列処理用マルチプロセッサシステム
- SMPサーバ及び組込み用マルチコア上でのOSCARマルチグレイン自動並列化コンパイラの性能(並列化コンパイラ)
- 瞬時電源遮断機構を用いたマルチコアSoC向け省電力ソフトウェア実行環境(組込みシステム,一般)
- ヘテロジニアスマルチコアプロセッサ上でのスタティックスケジューリングを用いたMP3エンコーダの並列化
- マルチコアにおけるParallelizable Cプログラムの自動並列化
- 階層型マクロデータフロー処理のためのダイナミック/スタティック併用スケジューリング手法
- 階層型マクロデータフロー処理のためのマクロタスクスケジューリング手法
- マルチプラットフォーム・マクロデータフローコンパイラの開発
- 主記憶共有マルチプロセッサシステム上でのマクロデータフロー処理の性能評価
- マルチプロセッサスーパーコンピュータ上でのFORTRANプログラムのマクロデータフロー処理
- 共有メモリ型マルチプロセッサシステム上でのFortran粗粒度タスク並列処理の性能評価
- OSCAR マルチグレインコンパイラにおける階層型マクロデータフロー処理手法
- 階層的マクロデータフロー処理のインプリメント手法
- 階層型マクロデータフロー処理におけるサブルーチン並列処理手法
- マルチプロセッサシステム上でのCFDの並列処理に関する研究
- データ転送と処理のオーバーラップを考慮したヒューリスティックマルチプロセッサスケジューリングアルゴリズムの最適化アルゴリズムを用いた性能評価
- 2D-4 OSCARマルチグレイン並列化コンパイラにおける階層的並列処理手法
- マルチグレイン並列処理用シングルチップマルチプロセッサアーキテクチャ
- 階層型マクロデータフロー処理におけるデータローカライゼーション手法
- 処理とデータ転送のオーバーラッピングを考慮したダイナミックスケジューリングアルゴリズム
- マクロデータフロー処理における処理とデータ転送のオーバーラップ
- データ転送と処理のオーバーラップを用いたマクロタスクスケジューリング手法
- データ転送と処理のオーバラップを用いたデータ転送最小化自動並列化コンパイラ
- 実用レベルのマルチグレインFORTRANコンパイラの開発
- 無同期近細粒度並列処理における並列コードスケジューリング
- マルチグレイン並列処理におけるデータローカライゼーションのための近細粒度タスクスケジューリング
- スタティックスケジューリングを用いたマルチプロセッサシステム上での無同期近細粒度並列処理
- 無同期細粒度並列処理のためのデータ転送順序最適化
- 階層並列実行ジョブ間スケジューリング手法
- マクロデータフロー処理のマルチジョブ実行手法
- Fortran プログラム粗粒度タスクの OSCAR における並列実行方式
- Fortran マクロデータフロー処理のマクロタスク生成手法