Skip to main content
QUICK REVIEW

[논문 리뷰] Reconstructing a website's lost past: Methodological issues concerning the history of www.unibo.it

Federico Nanni|arXiv (Cornell University)|2016. 04. 20.
Digital Humanities and Scholarship인용 수 3
한 줄 요약

이 논문은 13년 동안 인터넷 아카이브의 웨이백 머신에서 제외된 볼로냐 대학교 웹사이트(www.unibo.it)의 상실된 디지털 역사 복원을 위한 방법론적 프레임워크를 제시한다. 보다 다른 웹 아카이브 기법과 보유 디지털 자료를 활용함으로써, 공식 아카이브의 누락으로 인해 손실된 기관 웹 역사가 어떻게 복원되고 분석될 수 있는지 보여주며, 학술 기관의 디지털 유산 연구에 재사용 가능한 모델을 제공한다.

ABSTRACT

This paper describes how born digital primary sources could be used to reconstruct the recent history of scientific institutions. The case study is an analysis of the first 25 years online of the University of Bologna. The focus of this work is primarily methodological: several different issues are presented, starting with the fact that the University of Bologna website has been excluded for thirteen years from the Internet Archive's Wayback Machine, and possible solutions are proposed and applied. The article is organised in three parts: in the first one, some of the fundamental concepts on web archives and the preservation of born digital sources are introduced. Then the reconstruction of the University of Bologna web's past is presented. Finally the future of this research is described, presenting a specific case study in which the historian's craft will be challenged by a completely different issue, namely the large amount of data available in the university digital library.

연구 동기 및 목표

  • 공식 웹 아카이브가 불완전하거나 누락된 경우 학술 기관의 디지털 역사 복원에 도전하는 것.
  • 손실된 웹사이트 콘텐츠를 다른 디지털 자료에서 복구하기 위한 방법론적 접근법을 개발하고 적용하는 것.
  • 생산된 디지털 1차 자료가 과학 기관에 대한 역사 연구에 어떻게 활용될 수 있는지 입증하는 것.
  • 향후 디지털 아카이브 연구에서 데이터 양과 복잡성이 초래하는 영향을 탐구하는 것.

제안 방법

  • 인터넷 아카이브의 웨이백 머신에 존재하지 않는 볼로냐 대학교 웹사이트의 콘텐츠를 복원하기 위해 보다 다른 웹 아카이브 도구와 기법을 활용하는 것.
  • 디지털 라이브러리 데이터와 메타데이터를 적용하여 기관 웹 존재의 시간적 흐름과 진화를 재구성하는 것.
  • 웹 크롤링, 메타데이터 추출 및 아카이브 분석을 결합하여 여러 시간대에 걸친 웹사이트 콘텐츠를 복원하는 것.
  • 역사적 데이터의 타당성을 검증하기 위해 디지털 라이브러리 자원과 웹 아카이브 복원을 융합한 혼합 방법론 접근법을 사용하는 것.
  • www.unibo.it의 사례를 테스트 베드로 삼아 기관 웹 역사 연구를 위한 방법론 프rotocol을 정교화하는 것.
  • 공식 수집품에 누락이 있는 상황에서도 향후 역사학자들이 체계적으로 기관 웹 아카이브를 복원하고 분석할 수 있도록 프레임워크를 수립하는 것.

실험 결과

연구 질문

  • RQ1주요 웹 아카이브에서 공식 웹 존재가 누락된 학술 기관의 디지털 역사가 어떻게 복원될 수 있는가?
  • RQ2손실된 웹사이트 콘텐츠를 다른 디지털 자료에서 복구하기 위해 어떤 방법론 전략을 적용할 수 있는가?
  • RQ3웹 아카이브의 누락이 기관 디지털 기록의 역사적 정확성과 완전성에 어떤 영향을 미치는가?
  • RQ4생산된 디지털 1차 자료는 기관 웹 역사 복원에서 어떤 역할을 하는가?
  • RQ5거대한 데이터 볼륨을 지닌 대규모 기관 디지털 라이브러리에서 디지털 아카이브 연구를 확장할 때 발생하는 도전 과제는 무엇인가?

주요 결과

  • 연구는 인터넷 아카이브의 웨이백 머신에서 13년간 제외된 상태였음에도 불구하고 볼로냐 대학교 웹사이트의 25년 이상의 역사 복원에 성공했다.
  • 보다 다른 웹 아카이브 기법을 통해 웹사이트의 역사적 콘텐츠와 구조적 진화를 부분적으로는 하지만 신뢰성 있게 복원할 수 있었다.
  • 연구는 생산된 디지털 자료가 메타데이터와 디지털 라이브러리 자원과 결합될 경우, 누락된 웹 아카이브의 유력한 대체 자료로 기능할 수 있음을 입증했다.
  • 개발된 방법론적 프레임워크는 유사한 아카이브 누락 문제를 겪는 다른 학술 기관에 적용 가능한 것으로 밝혀졌다.
  • 연구는 기관 디지털 라이브러리에서 데이터의 양과 복잡성이 향후 디지털 역사 연구에 새로운 중요한 과제로 작용한다는 점을 드러냈다.

더 나은 연구,지금 바로 시작하세요

논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.

카드 등록 없음 · 무료 플랜 제공

이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.