Skip to main content
QUICK REVIEW

[論文レビュー] A Principled Framework for Constructing Natural Language Interfaces To Temporal Databases

Ioannis Androutsopoulos|arXiv (Cornell University)|Sep 23, 1996
Semantic Web and Ontologies参考文献 118被引用数 15
ひとこと要約

この論文は、時制・アスペクト理論、時系列論理、データベース意味論を統合することで、時系列データベース(NLI-TDB)に対する自然言語インタフェースを構築する原則的フレームワークを提示する。形式的時系列意味表現言語(Top)を導入し、HPSG文法を拡張して英語の時系列クエリをTop式にマッピングする。さらに、TopからT-SQL2への正しく訳出可能であることを証明し、時系列対応データベースの正確な照会を可能にする。

ABSTRACT

Most existing natural language interfaces to databases (NLIDBs) were designed to be used with ``snapshot'' database systems, that provide very limited facilities for manipulating time-dependent data. Consequently, most NLIDBs also provide very limited support for the notion of time. The database community is becoming increasingly interested in _temporal_ database systems. These are intended to store and manipulate in a principled manner information not only about the present, but also about the past and future. This thesis develops a principled framework for constructing English NLIDBs for _temporal_ databases (NLITDBs), drawing on research in tense and aspect theories, temporal logics, and temporal databases. I first explore temporal linguistic phenomena that are likely to appear in English questions to NLITDBs. Drawing on existing linguistic theories of time, I formulate an account for a large number of these phenomena that is simple enough to be embodied in practical NLITDBs. Exploiting ideas from temporal logics, I then define a temporal meaning representation language, TOP, and I show how the HPSG grammar theory can be modified to incorporate the tense and aspect account of this thesis, and to map a wide range of English questions involving time to appropriate TOP expressions. Finally, I present and prove the correctness of a method to translate from TOP to TSQL2, TSQL2 being a temporal extension of the SQL-92 database language. This way, I establish a sound route from English questions involving time to a general-purpose temporal database language, that can act as a principled framework for building NLITDBs. To demonstrate that this framework is workable, I employ it to develop a prototype NLITDB, implemented using ALE and Prolog.

研究の動機と目的

  • 既存の自然言語データベースインタフェース(NLI-DDB)は主に現在形のクエリを扱い、複雑な時系列表現を無視するなど、堅牢な時系列サポートに欠けるという問題に対処する。
  • 時制、アスペクト、時系列副詞、並列節などの自然言語における時系列現象を、形式的意味論枠組み内で統一的かつ言語学的根拠に基づいて解釈するアプローチを構築する。
  • 自然言語の時間関連質問を、標準的な時系列データベース言語(T-SQL2)に正確に変換する、正しく体系的な翻訳パイプラインを確立する。
  • AISG文法システムとPrologを用いて実装されたプロトタイプにより、フレームワークの実現可能性を実証する。このプロトタイプは、非自明な英語時系列クエリの断片を処理可能である。

提案手法

  • 時制、アスペクト、副詞、並列節などの時系列言語現象を、時制・アスペクト理論および時系列論理の知見を用いて形式化する。
  • 時系列表現の意味を、表現力と計算的扱いやすさの両方を満たすように、Topと呼ばれる時系列意味表現言語を定義する。
  • HPSG(ヘッドドリブン・フレーズ構造文法)を、新たな時制・アスペクトの説明を備えて拡張し、多様な英語時系列クエリを同等のTop式にマッピングする。
  • Top式からT-SQL2(SQL-92の時系列拡張)への翻訳手法を設計し、意味的同等性を保証する形式的証明を実施する。
  • ALE文法開発システムとPrologを用いて、NLI-TDBのプロトタイプを実装し、実際の分野(航空交通管制)でフレームワークを検証する。
  • 特徴構造表現と制約ベース解析を用いて、複雑な時系列クエリの正確な意味解釈を保証する。

実験結果

リサーチクエスチョン

  • RQ1動詞の時制、アスペクト的クラス、時系列副詞などの自然言語時系列表現を、形式的時系列意味論に体系的にマッピングする方法は何か?
  • RQ2英語における時系列現象の全範囲を表現できるだけの表現力を持ちつつ、データベースクエリ言語と互換性を持つ形式的表現言語とは何か?
  • RQ3HPSGのような文法形式主義を、時系列言語構造を形式的意味表現に正しく解釈・マッピングできるようにどのように拡張できるか?
  • RQ4形式的時系列意味表現(Top)から標準的な時系列データベース言語(T-SQL2)への翻訳において、正しい・整合的な方法は何か?
  • RQ5原則的で言語学的根拠に基づいたフレームワークを、実際に動作するプロトタイプとして実装でき、時間関連の自然言語質問を実行可能なデータベースクエリに正確に変換できるか?

主な発見

  • このフレームワークは、複雑な時制、アスペクト的クラス、時系列副詞を含む広範な英語時系列クエリを、形式的意味表現(Top)に正しくマッピングできることを示している。
  • Top言語は、「~より前」「~より後」「~中に」「~の間」などの時系列関係を、時系列データベースシステムと互換性を持つ方法で、原則的かつ正確に表現可能である。
  • TopからT-SQL2への翻訳は形式的に正しく証明されており、元の自然言語クエリの意味が生成されたデータベースクエリに正確に保たれることを保証する。
  • ALEとPrologを用いて実装されたプロトタイプNLI-TDBは、非自明な英語時系列クエリの断片を正しく処理できることを示し、フレームワークの実用的実現可能性を裏付けている。
  • 状態、行動、完了行動などのアスペクトの微細な違いと、それらが「~より前」「~より後」の節や時系列副詞とどのように作用するかを、正確な意味的境界で処理している。
  • 形式的時系列論理に根拠を置くことで、従来のシステムでよく見られる、恣意的またはヒューリスティックな解釈を避けることにより、時系列表現の曖昧さを解消している。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。