Skip to main content
QUICK REVIEW

[論文レビュー] Application-driven automatic subgrammar extraction

Renate Henschel, John Bateman|arXiv (Cornell University)|Nov 19, 1997
Natural Language Processing Techniques参考文献 9被引用数 3
ひとこと要約

本稿では、大規模なシステム文法から一貫性がありタスク固有の部分文法を自動で抽出する応用指向の手法を提示する。この手法は、システム文法とタイプ付き統合に基づく文法の間の形式的同等性を活用している。このアプローチにより計算コストが低減され、再利用が可能になる。評価では、抽出された部分文法を用いてエンサイクロペディアの項目を効果的に生成した。

ABSTRACT

The space and run-time requirements of broad coverage grammars appear for many applications unreasonably large in relation to the relative simplicity of the task at hand. On the other hand, handcrafted development of application-dependent grammars is in danger of duplicating work which is then difficult to re-use in other contexts of application. To overcome this problem, we present in this paper a procedure for the automatic extraction of application-tuned consistent subgrammars from proved large-scale generation grammars. The procedure has been implemented for large-scale systemic grammars and builds on the formal equivalence between systemic grammars and typed unification based grammars. Its evaluation for the generation of encyclopedia entries is described, and directions of future development, applicability, and extensions are discussed.

研究の動機と目的

  • 広範囲カバーの文法が単純な言語生成タスクにおいて高いメモリ使用量と実行時間コストをもたらす問題に対処すること。
  • 手作業で作成されたアプリケーション固有の文法が重複が多く、再利用性が低いという問題を克服すること。
  • 検証済みの大規模な生成文法から一貫性がありアプリケーションに適合した部分文法を自動で抽出する手順を開発すること。
  • 抽出された部分文法が、ターゲットアプリケーションにおいて形式的整合性と言語的適切性を維持することを保証すること。
  • エントリ生成への応用を通じて、実現可能性と有効性を示すこと。

提案手法

  • 本手法は、システム文法とタイプ付き統合に基づく文法の間の形式的同等性を活用し、体系的な変換を可能にする。
  • アプリケーション固有の入力・出力要件に基づいて、関連する文法構成要素を自動で同定・抽出する。
  • 元の文法の形式的構造と制約を保持することで、部分文法の一貫性を保証する手順を実施する。
  • 大規模な文法処理と部分文法導出を支援する計算フレームワーク内に本アプローチを実装する。
  • 部分文法の品質と生成性能を検証するために、エンサイクロペディアの項目から構成されるコーパスを用いて評価を実施する。
  • モジュラーな部分文法抽出により、異なる言語的アプリケーション間での拡張性と再利用性を支援する。

実験結果

リサーチクエスチョン

  • RQ1大規模なシステム文法から一貫性がありアプリケーション固有の部分文法を自動で抽出することは可能か?
  • RQ2システム文法とタイプ付き統合文法の間の形式的同等性をどのように活用すれば、部分文法の一貫性を保証できるか?
  • RQ3抽出された部分文法は、ターゲットの生成タスクにおいてどの程度言語的適切性を維持しているか?
  • RQ4抽出された部分文法の性能は、完全な文法と比較して効率性と正確性の面でどのように異なるか?
  • RQ5異なるアプリケーション間での文法構成要素の再利用性と保守性にどのような実用的意義があるか?

主な発見

  • 自動部分文法抽出手順により、大規模なシステム文法から一貫性がありアプリケーションに適合した文法が効果的に生成された。
  • 抽出された部分文法は、高品質なエンサイクロペディア項目の生成に十分であり、実用的応用性が裏付けられた。
  • 言語的正しさと構造的一致性を維持しつつ、計算リソースの要請を低減した。
  • システム文法とタイプ付き統合文法の間の形式的同等性により、信頼性が高く体系的な部分文法導出が可能になった。
  • 本アプローチにより、異なるアプリケーション間での文法構成要素の再利用が可能となり、重複と保守コストの低減が達成された。
  • 評価結果から、本手法が実世界の生成タスクにおいて実現可能で有効であることが確認された。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。