[论文解读] Annotating High-Level Structures of Short Stories and Personal Anecdotes
本文提出了一种新颖的标注方案,将Labov和Waletzky的功能性叙事结构理论与Freytag的戏剧金字塔理论相结合,用于标注360篇短篇小说和真人轶事中的高层级叙事结构。通过将文学理论转化为一致的框架,作者们创建了一个宝贵的资源,有助于推动自然语言处理系统对叙事理解的计算化发展。
Stories are a vital form of communication in human culture; they are employed daily to persuade, to elicit sympathy, or to convey a message. Computational understanding of human narratives, especially high-level narrative structures, remain limited to date. Multiple literary theories for narrative structures exist, but operationalization of the theories has remained a challenge. We developed an annotation scheme by consolidating and extending existing narratological theories, including Labov and Waletsky's (1967) functional categorization scheme and Freytag's (1863) pyramid of dramatic tension, and present 360 annotated short stories collected from online sources. In the future, this research will support an approach that enables systems to intelligently sustain complex communications with humans.
研究动机与目标
- 开发一种统一的标注方案,将现有的叙事学理论转化为计算分析叙事的实用框架。
- 填补现有计算系统在理解短篇小说和个人轶事中高层级叙事结构方面的空白。
- 创建一种标准化、可扩展的框架,用于标注叙事组件,如背景介绍、冲突发展、评价和结局。
- 支持未来具备复杂、类人叙事交互能力的系统开发。
- 提供一个公开可获取的数据集,包含360篇经标注的短篇小说和轶事,以促进计算叙事理解领域的研究。
提出的方法
- 作者将Labov和Waletzky(1967)对叙事的功能性分类与Freytag(1863)的戏剧金字塔理论相结合,定义了一个全面的标注模式。
- 该标注方案包含结构化组件,如背景介绍、冲突发展、评价和结局,与戏剧张力弧线相一致。
- 研究团队从在线来源收集了360篇短篇小说和真人轶事,确保其体裁和叙事风格的多样性。
- 每篇叙事均由受过训练的标注员使用所提出的标注模式进行标注,并通过标注者间一致性测量来确保可靠性。
- 最终数据集的结构设计旨在支持下游自然语言处理任务,如叙事生成、摘要生成和情感分析。
- 该框架设计为可扩展且可适应,适用于对话系统及其他人机交互应用。
实验结果
研究问题
- RQ1如何将既有的叙事学理论转化为计算可用的一致标注方案?
- RQ2在短篇小说和真人轶事中,哪些结构组件是普遍存在的?它们如何与文学理论相契合?
- RQ3统一的标注框架在多大程度上能够捕捉不同类型叙事中的高层级叙事结构?
- RQ4该标注流程在大规模叙事数据集上的可靠性与可扩展性如何?
- RQ5该标注数据集在提升计算叙事理解模型方面的潜力是什么?
主要发现
- 所提出的标注方案成功地将Labov和Waletzky的功能模型与Freytag的戏剧张力金字塔整合为一个连贯的框架。
- 360篇经标注的叙事数据集表明,该标注方案在多种叙事类型中均得到一致应用。
- 标注者间一致性达到了可靠水平,验证了标注指南的清晰性与一致性。
- 该数据集为训练和评估自然语言处理中的叙事理解系统提供了基础性资源。
- 功能性和戏剧性叙事结构的整合,使得叙事发展与情感弧线的计算建模更加精细。
- 该工作为能够生成、理解并维持与人类复杂叙事互动的系统铺平了道路。
更好的研究,从现在开始
从阅读论文到最终审阅,大幅缩短您的研究时间。
无需绑定信用卡
本解读由 AI 生成,并经人工编辑审核。