Skip to main content
QUICK REVIEW

[논문 리뷰] Syntax and Semantics of Italian Poetry in the First Half of the 20th Century

Rodolfo Delmonte|arXiv (Cornell University)|2018. 02. 11.
Natural Language Processing Techniques참고 문헌 10인용 수 3
한 줄 요약

이 논문은 20세기 초반 이탈리아 시에서 비표준적인 문법적 및 의미적 구조를 분석하기 위해 어휘 기반 기능 문법(LFG)을 사용하여 문법적 끊김과 정보적, 심리언어학적 복잡성 간의 연결을 규명한다. 통계적 파서와 기호 규칙 기반 시스템(Getarun)을 비교하여, 후자가 비표준적인 끊김 요소를 처리하고 전체적인 의미 및 맥락 분석을 수행할 수 있는 능력 덕분에 후자의 성능이 훨씬 뛰어나다는 것을 입증한다.

ABSTRACT

In this paper we study, analyse and comment rhetorical figures present in some of most interesting poetry of the first half of the twentieth century. These figures are at first traced back to some famous poet of the past and then compared to classical Latin prose. Linguistic theory is then called in to show how they can be represented in syntactic structures and classified as noncanonical structures, by positioning discontinuous or displaced linguistic elements in Spec XP projections at various levels of constituency. Then we introduce LFG (Lexical Functional Grammar) as the theory that allows us to connect syntactic noncanonical structures with informational structure and psycholinguistic theories for complexity evaluation. We end up with two computational linguistics experiments and then evaluate the results. The first one uses best online parsers of Italian to parse poetic structures; the second one uses Getarun, the system created at Ca Foscari Computational Linguistics Laboratory. As will be shown, the first approach is unable to cope with these structures due to the use of only statistical probabilistic information. On the contrary, the second one, being a symbolic rule based system, is by far superior and allows also to complete both semantic an pragmatic analysis.

연구 동기 및 목표

  • 20세기 초반 이탈리아 시에서의修辞적 및 문법적 비표준 구조를 조사하기 위해.
  • 복잡한 시적 문법을 분석할 때 통계적 파서와 기호 규칙 기반 시스템 간의 성능을 비교하기 위해.
  • 어휘 기반 기능 문법(LFG)을 활용하여 문법적 끊김과 정보 구조 간의 연결을 모델링하기 위해.
  • 컴퓨터 시스템이 시적 텍스트의 의미적 및 맥락적 복잡성을 얼마나 잘 포착하는지 평가하기 위해.
  • 확률 기반 파서가 현대주의 시에서 흔히 볼 수 있는 비표준적, 끊김이 있는 구조를 다루는 데에 한계가 있음을 입증하기 위해.

제안 방법

  • 고전 라틴 문학의 수사적 수법을 이탈리아 시에 적용하여 문법적 이질성을 규명하기 위해.
  • 비표준적 구조를 문법 수준 전반에서 특징적 XP 투사 내의 끊김 또는 이동된 요소로 표현하기 위해.
  • 어휘 기반 기능 문법(LFG)을 사용하여 문법적 구조와 정보적, 심리언어학적 복잡성 간의 연결을 수립하기 위해.
  • 두 가지 계산 실험 수행: 최신 기술의 통계적 이탈리아어 파서를 사용하는 실험과 베니스의 카 파스카리 계산 언어학 연구소에서 개발한 기호 시스템 Getarun을 사용하는 실험.
  • 문법적 파서 정확도와 의미 및 맥락 분석 능력에 기반하여 두 시스템의 성능 평가하기.
  • LFG를 사용하여 시적 텍스트에서 문법적 끊김과 정보 구조 간의 관계를 형식화하기.

실험 결과

연구 질문

  • RQ1어떻게 20세기 초반 이탈리아 시의 비표준 문법적 구조를 문법 이론을 사용하여 형식적으로 표현할 수 있는가?
  • RQ2통계적 파서는 시적 문법에서 끊김이 있거나 이동된 요소를 얼마나 잘못 처리하는가?
  • RQ3Getarun과 같은 기호 규칙 기반 시스템이 복잡한 시적 구조를 파싱하는 데서 통계적 파서를 능가할 수 있는가?
  • RQ4LFG는 어떻게 시적 분석에서 문법적, 의미적, 심리언어학적 복잡성을 통합하는 데 기여하는가?
  • RQ5수사적 수법은 현대주의 이탈리아 시의 문법적 끊김을 어떻게 형성하는가?

주요 결과

  • 확률적 정보에 의존하는 통계적 파서는 이탈리아 시의 비표준적, 끊김이 있는 문법적 구조를 정확히 파싱하지 못한다.
  • 기호 규칙 기반 시스템인 Getarun은 통계적 파서가 실패하는 복잡한 시적 구조를 성공적으로 파싱한다.
  • Getarun은 문법적 파싱을 넘어서 시적 텍스트의 전체적인 의미적 및 맥락적 분석을 가능하게 한다.
  • LFG는 문법적 끊김과 정보 구조, 인지적 복잡성 간의 관계를 설명하는 견고한 이론적 프레임워크를 제공한다.
  • 이 연구는 비표준적 시적 문법을 분석할 때 기호 시스템이 통계 모델보다 더 적합하다는 것을 입증한다.
  • 결과는 끊김이 있는 요소가 무작위가 아니라 체계적인 문법적 및 의미적 패턴을 따르며, 형식적 모델링이 가능하다는 것을 확인한다.

더 나은 연구,지금 바로 시작하세요

논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.

카드 등록 없음 · 무료 플랜 제공

이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.