Simple PCAを用いたベクトル空間情報検索モデルの次元削減
スポンサーリンク
概要
- 論文の詳細を見る
ベクトル空間モデル(VSM)は情報検索における代表的な検索モデルである.同モデルでは文書が単語の出現頻度に基づくベクトルで表現されるため, そのベクトル空間は一般にスパースかつ高次元となりメモリや検索時間の増大を招くとともに, 文章中に含まれる無意味な単語がノイズ的な影響を及ぼし検索精度を低下させるという問題を生じる.これに対し特異値分解(SVD)を用い次元数を削減した空間で類似度を計算する潜在的意味インデキシング(Latent Semantic Indexing, LSI)が提案され, その効果が報告されている.本稿ではSVDに比べより少ない演算量で近似的に主成分分析を行うことが可能なSimple Principal Component Analysis(SPCA)を次元削減に適用する.MEDLINEコレクションを用いた検索実験を行った結果, SVDと同等以上の検索性能をSPCAにより達成した.
- 一般社団法人情報処理学会の論文
- 2001-07-16
著者
-
北 研二
徳島大学工学部
-
獅々掘 正幹
徳島大学工学部
-
黒岩 眞吾
徳島大学工学部
-
柘植 覚
徳島大学工学部
-
獅々堀 正幹
徳島大学大学院ソシオテクノサイエンス研究部情報ソリューション部門
-
柘植 覚
徳島大学大学院ソシオテクノサイエンス研究部情報ソリューション部門
-
北 研二
徳島大学
-
田仁 宏典
徳島大学工学部知能情報工学科
-
Xiaoying Tai
徳島大学工学部知能情報工学科
-
獅子堀 正幹[他]
徳島大学工学部
関連論文
- 距離索引VP-treeにおける解絞込みの一改良手法(マルチメディアデータベース,データ工学論文)
- PPM^*言語モデルを用いた日本語単語分割
- PPM^*モデルによる日本語単語分割
- 単語の位置情報に基づくコーパスからのコロケーションの自動抽出
- 単語の出現位置情報を用いたコーパスからのコロケーションの自動抽出
- 文字クラスモデルによる日本語単語分割
- 文字クラスモデルに基づく日本語単語分割
- 大規模文書データに対する用例文の効率的検索アルゴリズム
- 感情計測システムについて(福祉と言語処理, 一般)
- 感情計測システムについて(福祉と言語処理,一般)
- WWW画像検索システムを用いた関連語の自動収集手法(検索)
- 講義映像配信システムにおける講義映像と資料の対応
- フィルタバンク特徴量とEarth Mover's Distanceを用いた音楽検索
- 教師あり学習によるベクトル空間情報検索モデルの精度改善
- 順位統計量を用いた話者照合のためのコホート話者選択方法
- Earth Mover's Distanceを用いたハミングによる類似音楽検索手法(音楽情報検索,便利で身近な音楽情報処理)
- 順位統計量を用いた話者照合のためのコホート話者選択方法
- 符号化音声認識のための合成音声を用いた不特定話者音響モデルの適応法(音声,聴覚)
- 分散音声認識における実時間周波数特性正規化手法(音声言語)
- ハミングによる検索機能を備えた音楽配信システムの開発
- 順位統計量を用いた話者照合のためのコホート話者選択方法(一般(ポスターセッション),第11回音声言語シンポジウム)
- サフィックス・アレイに基づく言語モデルを用いた音声認識に関する研究
- 検索質問と字幕の文字画像特徴量間の距離に基づく字幕検索手法
- G-003 距離尺度にEarth Mover's Distanceを用いたハミングによる類似音楽検索手法(G分野:音声・音楽)
- 仕事量基準を用いたコーパスからの定型表現の自動抽出
- 適応エコーキャンセラにおけるステップゲイン制御法(信号処理,スペクトル拡散,及び一般)
- 適応エコーキャンセラにおけるステップゲイン制御法(信号処理,スペクトル拡散,及び一般)
- 13-105 学生自主プロジェクト活動実態に関する考察((17)工学教育システムの個性化・活性化-II)
- 多属性項目の履歴情報に基づく電子メイル文書のフィルタリング手法
- 多属性項目の履歴情報に基づく電子メイル文書のフィルタリング手法
- 各個人のプロファイルを用いたメイル文書のフィルタリング手法
- 履歴情報を考慮したメイル文書のフィルタリング手法
- WWW画像検索システムにおける有害画像フィルタリング手法
- D-020 WWW画像検索システムにおける有害画像フィルタリング手法(D分野:データベース)
- D-030 WWW画像検索システムを用いた有害サイトURLデータベースの構築手法(D.データベース)
- 距離索引VP-treeにおける解絞り込みの一改良法(基盤・要素技術)(セマンティックウェブと自然言語処理その他一般)
- 距離索引VP-treeにおける解絞り込みの一改良法
- ベクトル空間モデルに基づく特定領域向け中国語質問応答システムの構築
- 発話タイプ付きコーパスを用いた確率的対話モデルの自動生成
- 確率・統計的手法による対話構造のモデル化
- 確率・統計モデルの音声言語処理への応用 ( 「コーパスに基づく音声・自然言語処理」)
- 音声言語の確率モデル ( 「コーパスに基づく音声・自然言語処理」)
- 分野連想語の出現位置に基づく話題分野の特定手法
- 分野連想語を用いたパッセージ特定手法
- 感情計測システムについて(福祉と言語処理, 一般)
- 単語の出現位置情報を用いたコーパスからのコロケーションの自動抽出
- テキストと画像のクロスメディア情報検索に向けた画像キーワード登録システムの開発
- 時間推移を考慮した単語の重要度決定手法
- 質問応答システムにおける質問文内の漢字文字列に対する用語特定手法(「ユニバーサルコミュニケーションを実現するための言語処理技術」シンポジウム)
- Earth Mover's Distance の高速検索ライブラリ fastEMD の開発
- 字幕付き映像データからの字幕領域の検出手法
- 順位キューを用いた多次元データの高速近傍検索アルゴリズム
- 出現URLの類似性に着目したWWW空間からの関連語自動収集手法(抽出, 言い換え)
- 中国の自然言語処理について
- 音声認識・音声合成を用いた音声途切れ補間手法
- 統計的手法を用いた音声信号の復元手法の改良
- MPEG映像データに対するカットシーンの高速検出手法
- D-040 領域分割画像に基づく言語メタデータの自動生成手法(D.データベース)
- 機械翻訳における使役表現の翻訳規則について(機械翻訳)
- 顔特徴を用いた表情の認識(福祉と言語処理, 一般)
- 顔特徴を用いた表情の認識(福祉と言語処理,一般)
- 距離反比例型スコアを導入したコロケーションの自動抽出法
- 自然言語処理技術を用いた中学理科教授学習システム(福祉と言語処理, 一般)
- 自然言語処理技術を用いた中学理科教授学習システム(福祉と言語処理,一般)
- 自然言語処理技術を用いた中学理科教授学習システム(福祉と言語処理, 一般)
- 自由発話音声認識における音響分析の比較
- 周波数特性の変動に頑健な実時間分散音声認識手法(第5回音声言語シンポジウム : 耐雑音)
- 周波数特性の変動に頑健な実時間分散音声認識手法(第5回音声言語シンポジウム : 耐雑音)
- 日本語音声コーパスを用いた ETSI STQ DSR Advanced Front-End の評価
- World Wide Webからの対訳データの自動収集
- 情報検索のための概念ベクトル生成手法
- PDDPによる概念ベクトルを用いた情報検索システム
- PDDPによる概念ベクトルを用いた情報検索システム
- ランダム・プロジェクションによるベクトル空間モデルの次元削減
- オーディオ指紋検索に適した高速なハミング空間検索
- 音声認識・音声合成を用いた音声途切れ補間手法
- LRパーザ制御によるOne-pass型連続音声認識アルゴリズム
- 日本語文における時間表現の形式化手法
- 複数雑音モデルを用いた風雑音除去手法(合成・生成,韻律,一般)
- 類似用例文の効率的検索手法とその応用
- サポートベクターマシンによる適合性フィードバックを用いた情報検索(情報検索)
- サポートベクターマシンによる適合性フィードバックを用いた情報検索
- 画像知識データベースを用いたWWW画像検索システムの開発(画像検索・映像データベース)
- 1次元自己組織化マップを用いた高次元データの高速近傍検索
- Non-negative Matrix Factorizationを用いた情報検索モデルの次元圧縮および検索質問拡張
- Earth Mover's Distanceを用いた分散型話者認識(合成・生成,韻律,一般)
- 大規模顔画像データベースに対する印象語による類似顔画像検索技術に関する研究
- 周波数特性の変動に頑健な分散音声認識手法
- ETSI標準分散音声認識フロントエンドを用いた音声認識実験
- PD-2-3 電話サービスのための音声認証技術
- 音素依存線形判別分析の検討
- Simple PCAを用いたベクトル空間情報検索モデルの次元削減
- 文字列照合マシンを利用した複合語キーワードの効率的抽出法
- Non-negative Matrix Factorizationを用いた情報検索
- 顔特徴を用いた表情の認識(福祉と言語処理, 一般)
- 情報検索システムの統計的手法による特徴と精度の分析
- ランダム・プロジェクションによるベクトル空間情報検索モデルの次元削除
- 解散フーリエ変換を用いたベクトル空間モデルの次元削減
- 教師あり学習によるベクトル空間モデルの精度改善
- 検索質問多重化による高速なオーディオ指紋検索