構文森を用いた実コーパスからの大規模な文脈自由文法の高速学習法
スポンサーリンク
概要
- 論文の詳細を見る
The task of inducing grammar structures has received a great deal of attention. The reasons why researchers have studied are different; to use grammar induction as the first stage in building large treebanks or to make up better language models. However, grammar induction has inherent computational complexity. To overcome it, some grammar induction algorithms add new production rules incrementally. They refine the grammar while keeping their computational complexity low. In this paper, we propose a new efficient grammar induction algorithm. Although our algorithm is similar to algorithms which learn a grammar incrementally, our algorithm uses the graphical EM algorithm instead of the Inside-Outside algorithm. We report results of learning experiments in terms of learning speeds. The results show that our algorithm learns a grammar in constant time regardless of the size of the grammar. Since our algorithm decreases syntactic ambiguities in each step, our algorithm reduces required time for learning. This constant-time learning considerably affects learning time for larger grammars. We also reports results of evaluation of criteria to choose nonterminals. Our algorithm refines a grammar based on a nonterminal in each step. Since there can be several criteria to decide which nonterminal is the best, we evaluate them by learning experiments.
- 社団法人 人工知能学会の論文
- 2004-11-01
著者
-
佐藤 泰介
東京工業大学大学院情報理工学研究科計算工学専攻
-
亀谷 由隆
東京工業大学大学院情報理工学研究科
-
栗原 賢一
東京工業大学大学院情報理工学研究科計算工学専攻
-
佐藤 泰介
東京工業大学
-
栗原 賢一
東京工業大学大学院情報理工学研究科
関連論文
- 統計的アブダクション(論理に基づく推論研究の動向)
- BDD上の命題化計算に基づくEMアルゴリズム
- 発見科学の構想と展開(発見科学)
- ベイジアンネットワークと離散構造処理系 (特集 ベイジアンネットワークの最先端)
- 統計的アブダクション
- ベイジアンネットと信念伝播の新潮流(自動推論 : 演繹, 帰納, モデル検査/生成, 仮説推論アブダクション, 論理プログラム, プランニング, 時相論理, etc.)
- ルールの本体での置換と選言標準形への変形による論理プログラムの計算手続き
- 論理式の置換と選言標準形への変形による論理プログラムの計算手続き
- 論理式の置換と選言標準形への変形による論理プログラムの計算手続き (テーマ:「予兆・チャンスの発見とその応用」および一般)
- 論理プログラムの新しい完備化と論理式の置換に基づく計算手続きについて