Skip to main content
QUICK REVIEW

[論文レビュー] A Lexicalized Tree Adjoining Grammar for English

XTAG Research Group|arXiv (Cornell University)|Sep 18, 1998
Natural Language Processing Techniques被引用数 8
ひとこと要約

本稿では、XTAGシステムに実装された、特徴構造および語彙化を組み込んだ標準的なTAGを拡張した大規模で語彙化された木適合文法(TAG)を提示する。この文法は、受動態、wh-節分離構造、上げ上げ構造、名詞+名詞修飾構造などを含む広範な構造をカバーし、自然言語処理応用分野における計算的根拠に基づいた高精度で拡張性の高い英語文法の包括的分析を提供する。

ABSTRACT

This document describes a sizable grammar of English written in the TAG formalism and implemented for use with the XTAG system. This report and the grammar described herein supersedes the TAG grammar described in an earlier 1995 XTAG technical report. The English grammar described in this report is based on the TAG formalism which has been extended to include lexicalization, and unification-based feature structures. The range of syntactic phenomena that can be handled is large and includes auxiliaries (including inversion), copula, raising and small clause constructions, topicalization, relative clauses, infinitives, gerunds, passives, adjuncts, it-clefts, wh-clefts, PRO constructions, noun-noun modifications, extraposition, determiner sequences, genitives, negation, noun-verb contractions, sentential adjuncts and imperatives. This technical report corresponds to the XTAG Release 8/31/98. The XTAG grammar is continuously updated with the addition of new analyses and modification of old ones, and an online version of this report can be found at the XTAG web page at http://www.cis.upenn.edu/~xtag/

研究の動機と目的

  • 木適合文法(TAG)形式を用いて、計算的根拠に基づいた大規模な英語文法を開発すること。
  • 語彙化と統合に基づく特徴構造をTAGに拡張し、構文の正確性とカバー範囲を向上させること。
  • 受動態、節分離構造、付加語、小節などを含む多様な複雑な構文的構造をモデル化すること。
  • 言語学的研究およびNLPシステム向けに、継続的に更新され、公開可能な文法リソースを提供すること。
  • 以前のXTAG文法のバージョンを、より正確で包括的な分析で置き換えること。

提案手法

  • 構文的構造は語彙的項目とその構文的特徴から導出される語彙化TAG形式に基づいて構築される。
  • 構文的および意味的制約を符号化するため、統合に基づく特徴構造が使用され、句構造と依存関係の精密な制御が可能になる。
  • 文法はXTAGシステムに実装されており、モジュラーでルールベースのアーキテクチャにより、段階的パーサーと言語学的分析をサポートする。
  • 各構文的構造は、木の付加と木の合成操作を用いて分析され、語彙的根が構文的導出の基盤を提供する。
  • 文法は手動でキュレートされ、体系的に拡張されており、コミュニティ利用のためのオンラインでの更新履歴が追跡・公開されている。
  • 形式的仕様は成分構造および非成分構造の両方をサポートしており、トピカル化や後置き配置などの非連続的現象のモデル化を可能にする。

実験結果

リサーチクエスチョン

  • RQ1語彙化TAG形式は、高精度で広範な英語構文的構造を効果的にカバーするようにどのように拡張可能か?
  • RQ2特徴構造は、語彙化TAGフレームワーク内での構文的導出の細かいつながりの制御にどのような役割を果たすか?
  • RQ3受動態、節分離構造、上げ上げ構造などの複雑な現象は、TAGベースの文法内でどのように体系的に符号化可能か?
  • RQ4一貫性とカバー範囲を維持しつつ、文法をモジュラーで拡張可能かつ継続的に更新可能にするにはどの程度可能か?
  • RQ5語彙化の統合は、自然言語処理におけるTAGの言語学的妥当性と計算効率をどのように向上させるか?

主な発見

  • XTAG文法は、倒置を伴う助動詞、補語構造、PRO制御を含む多様な構文的現象を一貫的かつ正確にモデル化している。
  • 統合に基づく特徴構造の統合により、多様な構造にわたり、構文的制約と一致現象の精密な処理が可能になった。
  • 文法は181の構文的構造をカバーしており、310ページのテキストと181枚のPostScript図が付随しており、その包括的範囲が明確に示されている。
  • システムは段階的パーサーと言語学的分析をサポートしており、計算言語学およびNLP応用分野での利用に適している。
  • 文法は継続的に更新されており、オンラインで公開されており、1998年8月31日時点のリリースが保証されており、継続的な関連性とコミュニティへのアクセスが確保されている。
  • 語彙化アプローチにより、各構文的木が語彙的頭部に固定されるため、導出の言語学的妥当性と解釈可能性が向上している。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。