Skip to main content
QUICK REVIEW

[论文解读] Analyzing Organizational Routines in Online Knowledge Collaborations: A Case for Sequence Analysis in CSCW

Brian Keegan, Shakked Lev|arXiv (Cornell University)|Aug 19, 2015
Wikis in Education and Collaboration参考文献 56被引用 5
一句话总结

本文提出将序列分析作为研究在线知识协作中组织常规(如维基百科)的基本方法,利用事件日志数据揭示编辑行为的重复模式。通过借鉴生物信息学与社会学的技术,作者识别出具有统计显著性的行为基序(如常见的修订序列),揭示分布式贡献者如何协调工作,为理解人机协同系统中的共同生产常规提供了新的混合方法路径。

ABSTRACT

Research into socio-technical systems like Wikipedia has overlooked important structural patterns in the coordination of distributed work. This paper argues for a conceptual reorientation towards sequences as a fundamental unit of analysis for understanding work routines in online knowledge collaboration. We outline a research agenda for researchers in computer-supported cooperative work (CSCW) to understand the relationships, patterns, antecedents, and consequences of sequential behavior using methods already developed in fields like bio-informatics. Using a data set of 37,515 revisions from 16,616 unique editors to 96 Wikipedia articles as a case study, we analyze the prevalence and significance of different sequences of editing patterns. We illustrate the mixed method potential of sequence approaches by interpreting the frequent patterns as general classes of behavioral motifs. We conclude by discussing the methodological opportunities for using sequence analysis for expanding existing approaches to analyzing and theorizing about co-production routines in online knowledge collaboration.

研究动机与目标

  • 为填补对在线知识协作中时间协调模式的理解空白,特别是静态或聚合网络分析的局限性。
  • 主张行动序列(而非孤立互动或网络结构)应作为研究人机协同系统中组织常规的基本分析单元。
  • 展示如何将生物信息学与社会学中的序列分析方法适配于同辈生产平台的纵向事件数据。
  • 通过识别贡献者活动中的重复且具有统计显著性的行为基序,为组织常规的语法模型提供实证支持。
  • 建立将序列分析整合进CSCW的研究议程,以实现对协作工作动态的更丰富、混合方法的探究。

提出的方法

  • 采用最初在生物信息学与社会学中发展出的序列分析技术,对在线知识协作中的编辑行为序列进行建模与比较。
  • 使用来自96篇维基百科文章中16,616名独立编辑的37,515次修订的事件日志,重建个体贡献者的活动序列。
  • 应用统计方法识别出显著高于或低于随机预期的序列,以指示潜在的行为基序或常规。
  • 将定性解释与定量序列模式相结合,将频繁序列解释为共同生产常规的一般类别。
  • 使用对齐与聚类技术比较不同贡献者之间的序列,识别互动与协调的主导模式。
  • 结合一阶行为指标(如编辑频率)与源自序列结构的二阶属性,使分析超越简单的计数或网络关系。

实验结果

研究问题

  • RQ1在在线知识协作中,哪些重复出现的编辑行为序列浮现?它们如何反映组织常规?
  • RQ2不同编辑与文章之间的贡献者行为序列在频率与结构上如何差异?这些差异揭示了何种协调模式?
  • RQ3观察到的序列在多大程度上偏离随机预期,表明存在有意或制度化的协调实践?
  • RQ4如何利用序列分析识别并解释作为同辈生产系统中共同生产基石的行为基序?
  • RQ5序列分析在何种方式上可补充或扩展现有的CSCW方法(如社会网络分析或内容分析)?

主要发现

  • 研究识别出显著高于随机预期的编辑行为序列,表明维基百科中存在结构化、可重复的共同生产常规。
  • 频繁出现的序列被解释为行为基序(如“编辑、评审、回退、重编辑”),反映了知识生产中的常见协调模式。
  • 某些序列的普遍性支持Feldman的组织常规表现性理论,即个体根据他人行为采纳或放弃特定行为。
  • 序列分析揭示了事件日志聚合为静态网络快照时无法捕捉的贡献者行为模式差异。
  • 该方法成功识别出常见常规与异常值,使对非典型或新兴实践的进一步定性审查成为可能。
  • 将序列分析与一阶指标(如编辑次数)及协变量(如编辑者状态、文章质量)相结合,展示了其在人机协同系统中开展混合方法探究的潜力。

更好的研究,从现在开始

从阅读论文到最终审阅,大幅缩短您的研究时间。

无需绑定信用卡

本解读由 AI 生成,并经人工编辑审核。