ビデオ画像における人間の歩行動作の3次元トラッキング(テーマセッション(1),人の検出・計測・認識)

概要

論文の詳細を見る
本研究では,単一ビデオデータにおける人間の動作をトラッキングするシステムを提案する.本手法では,まず各関節を特徴点として動画像のフレーム間の関節の動きを推定し,2次元上の動きの推定を行う.さらに,人体の骨格モデルに基づき,奥行きを推定することによって3次元トラッキングを行う.本手法では,モーションデータベースを使用しない.また,設備コストが少なく,安価で利用しやすい.モーションキャプチャシステムの測定データと提案手法を用いて推定した結果との相関度をもとめ,提案手法の評価を行った.
2006-05-18

著者

篠田浩一
東京工業大学
古井貞煕
東京工業大学
篠田浩一
NEC情報通信メディア研究本部
閔庚甫
東京工業大学

関連論文

シンボル列化したシーンの学習と2種のプレイ種相関度による野球放送映像プレイ種識別(画像・映像処理)
音声認識実用化技術の展開(総合報告)
SIFT混合ガウス分布と音響特徴を用いた映像からの高次特徴検出(テーマセッション関連,一般物体認識・画像特徴量)
WFST音声認識デコーダにおけるon-the-fly合成の最適化処理(音声,聴覚)
携帯端末上でのプロキシ編集(映像理論・映像システム,画像処理・符号化及び一般)
パネル討論 : 音声言語関連大型プロジェクトの現状と将来
区分線形変換による雑音適応法のための木構造クラスタリング法の検討
プロダクト・オブ・エキスパートを用いた話者識別
F_0パターン生成モデルのための数量化I類の平均値置換による話者適応法の検討(感情音声,韻律,声質,音声生成・知覚,脳機能,一般)
CHLAC特徴と隠れマルコフモデルを用いたGait認識(一般セッション2,複合現実感のためのパターン認識・理解)
統計的モデル選択によるシーン数の自動推定を用いた動画要約(一般セッション3,複合現実感のためのパターン認識・理解)
高精度音声認識のための教師なしクロスバリデーションおよび集合適応法の提案(認識)
耐雑音音声認識のためのハフ変換による基本周波数情報抽出の高速化
WFST音声認識デコーダの高機能化とその応用 : on-the-fly合成法の検討(プラットフォーム)
言語理解・意味理解の先駆者田中穂積先生の想い出(9)
2009年春季研究発表会(研究発表会報告)
第4回日米音響学会ジョイントミーティング
話者照合におけるモデルとしきい値の更新法
4)話者認識研究の現状と展望([マルチメディア情報処理研究会ネットワーク映像メディア研究会]合同)
話者認識研究の現状と展望
テキスト指定型話者認識
話者認識におけるモデルとしきい値の更新法の検討
合成HMMによる環境適応型話者認識法
音韻・話者独立モデルによる話者照合尤度の正規化
VQ ひずみ,離散/連続 HMM によるテキスト独立形話者認識法の比較検討
話者認識技術 (音声認識の最新技術)
音源・声道特徴を用いたテキスト独立形話者認識
編集にあたって(音声情報処理技術の最先端)
音声とペン入力の同時入力に対する認識方式の検討(認識・理解・対話・一般)
数値列化したイベントシーンの学習と試合進行状況情報による制約条件を用いた野球映像イベント識別(パターン認識・メディア理解のための学習理論とその周辺)
基本周波数情報を用いたダイナミックベイジアンネットワークによる音声認識(聴覚・音声・言語とその障害,一般)
音声と手書き文字の同時入力インターフェース(マルチモーダル, コーパス・言語モデル)
十分統計量を用いた教師なし話者適応における話者選択法(一般(ポスターセッション),第9回音声言語シンポジウム)
局所的な特徴と大局的な特徴を用いた監視カメラ映像からの行動イベント検出(一般,First Person Visionのための認識・理解)
音響モデル学習のための相対エントロピーを用いた学習文選択
音声と手書き文字の同時入力インターフェース(マルチモーダル, コーパス・言語モデル)
ハーモニック・クラスタリングによる多重音の基本周波数推定アルゴリズム
カテゴリ推定に基づく動的な言語モデル適応
大規模映像資源のためのマルチモーダル高次特徴検出(画像・映像処理)
十分統計量を用いた教師なし話者適応における話者選択法(一般(ポスターセッション),第9回音声言語シンポジウム)
十分統計量を用いた教師なし話者適応における話者選択法(一般(ポスターセッション),第9回音声言語シンポジウム)
音声認識における確率モデルの重み係数の自動推定(音声認識・識別,第9回音声言語シンポジウム)
音声認識における確率モデルの重み係数の自動推定(音声認識・識別,第9回音声言語シンポジウム)
音声認識における確率モデルの重み係数の自動推定(音声認識・識別,第9回音声言語シンポジウム)
会議音声認識のためのスペクトル減算に基づくオンライン音源分離(オーガナイズドセッション:スピーチエンハンスメント,音声,応用/電気音響,信号処理,及び一般)
局所的な特徴と大局的な特徴を用いた監視カメラ映像からの行動イベント検出(一般,First Person Visionのための認識・理解)
局所的な特徴と大局的な特徴を用いた監視カメラ映像からの行動イベント検出(一般,First Person Visionのための認識・理解)
木構造クラスタリングを用いた動画像からの高次特徴抽出(一般セッション1,文字・文書の認識・理解)
D-14-7 手書き文字の準同期入力を併用した音声認識手法の予備検討(D-14. 音声・聴覚)
2. 統計的手法を用いた音声モデリングの高度化とその音声認識への応用(音声情報処理技術の最先端)
SIFT混合ガウス分布を用いた一般物体認識のためのマルチカーネル学習(テーマセッション,コンピュータビジョンとパターン認識のための機械学習と最適化,一般)
SIFT混合ガウス分布を用いた一般物体認識のためのマルチカーネル学習(テーマセッション,コンピュータビジョンとパターン認識のための機械学習と最適化,一般)
投球の次ショットに重きを置いたシーンのパターン化と離散隠れマルコフモデルを用いた野球放送映像の自動イベント分類
隠れマルコフモデルを用いた野球放送の自動的インデクシング(顔・ジェスチャ認識のためのパターン認識メディア理解,一般)
隠れマルコフモデルを用いた野球放送の自動的インデクシング(顔・ジェスチャ認識のためのパターン認識メディア理解,一般)
会議音声認識のためのスペクトル減算に基づくオンライン音源分離(オーガナイズドセッション:スピーチエンハンスメント,音声,応用/電気音響,信号処理,及び一般)
会議音声認識のためのスペクトル減算に基づくオンライン音源分離(オーガナイズドセッション:スピーチエンハンスメント,音声,応用/電気音響,信号処理,及び一般)
事後確率最大化手法を用いた言語モデルの学習
確率モデルによる多声楽曲MIDI演奏からの楽譜推定
音声認識のための複数の認識器を利用した能動学習(音響モデル,第11回音声言語シンポジウム)
音声認識のための複数の認識器を利用した能動学習
講義音声認識における講義スライド情報の利用(第8回音声言語シンポジウム)
講義音声認識における講義スライド情報の利用(Session-6 音声認識,第8回音声言語シンポジウム)
ハイブリッドモデルに基づく単視点ビデオデータにおける人間の歩行動作のトラッキング
講義音声認識における講義スライド情報の利用(Session-6 音声認識,第8回音声言語シンポジウム)
講義音声認識における講義スライド情報の利用
ビデオ画像における人間の歩行動作の3次元トラッキング(テーマセッション(1),人の検出・計測・認識)
ビデオ画像における人間の歩行動作の3次元トラッキング(テーマセッション(1),人の検出・計測・認識)
マルチモーダル・マルチフレームな手法を用いたTRECVIDセマンティックインデクシング(テーマセッション,映像処理とTRECVID)
映像解析・検索評価ワークショップTRECVID2010の概要(テーマセッション,映像処理とTRECVID)
雑音下音声におけるスペクトル縮小の分析とその耐雑音音声認識への利用(音声一般,聴覚・音声・言語とその障害/一般)
木構造GMMを用いたセマンティックインデクシングの高速化(テーマセッション,大規模マルチメディアデータを対象とした次世代検索およびマイニング)
木構造GMMを用いたセマンティックインデクシングの高速化(テーマセッション,大規模マルチメディアデータを対象とした次世代検索およびマイニング)
D-12-120 動的特徴量を用いたHMMによる連続動作認識(D-12. パターン認識・メディア理解B)
クラウド時代の新しい音声研究パラダイム
複数ピンマイクで収音された会議音声の重畳区間検出
音声認識におけるモデル間スケーリング係数の自動推定(音声,聴覚)
映像の高性能なセマンティックインデクシングを目指して(テーマセッション,実世界文字認識と理解)
音声認識における転移学習 : 話者適応(知識の転移)
手話素単位を用いた大語彙手話認識(テーマセッション,時系列パターン認識)
手話素単位を用いた大語彙手話認識(テーマセッション,時系列パターン認識)
GMM-SupervectorとSVMを用いた映像からのイベント検出(テーマセッション,時系列パターン認識)
GMM-SupervectorとSVMを用いた映像からのイベント検出(テーマセッション,時系列パターン認識)
固定監視カメラからの人混み中の行動イベント検出(実世界センシングとその応用)
固定監視カメラからの人混み中の行動イベント検出(実世界センシングとその応用)
映像検索技術の新たな潮流
音声認識におけるモデル間スケーリング係数の自動推定
GMM-Supervector とSVMを用いた映像からのイベント検出
手話素単位を用いた大語彙手話認識
音声認識における転移学習 : 話者適応
映像のセマンティックインデクシングのためのq-混合ガウス分布
GMM-Supervector とSVMを用いた映像からのイベント検出
映像検索技術の新たな潮流
「音声認識」は今後こうなる!
映像のセマンティックインデクシングのためのq-混合ガウス分布(テーマセッション,コンピュータビジョンとパターン認識のための機械学習及び企業ニーズセッション)
話者認識技術の現状と課題(オーガナイズドセッション(パネルディスカッション),音声アプリケーション,一般)
カメラの動き補正に基づく時空間特徴量とGMM supervectorを用いた映像からのイベント検出(テーマセッション,大規模データベースとパターン認識)
映像のセマンティックインデクシングのためのq一混合ガウス分布(コンピュータビジョンとパターン認識のための機械学習及び企業ニーズセッション)
コミッティに基づく能動学習・半教師付き学習を用いた音声モデル
GMM Supervectorとビデオクリップスコアを用いた映像のセマンティックインデクシング(テーマセッション,大規模データベースとパターン認識)

ビデオ画像における人間の歩行動作の3次元トラッキング(テーマセッション(1),人の検出・計測・認識)

スポンサーリンク

概要

著者

関連論文

スポンサーリンク