[논문 리뷰] Open access institutional and news media tweet dataset for COVID-19 social science research
이 논문은 코로나19 팬데믹 초기 단계 기간 동안 정부 및 국제기구, 북미, 유럽, 아시아의 뉴스 매체를 포함한 69개의 기관 및 뉴스 미디어 트위터 계정의 오픈 액세스 데이터셋을 제시한다. 이 데이터셋은 트위터 API를 통해 수집되어 공개적으로 제공되며, 공중보건 위기 기간 동안 정보 유포, 미디어 프레임, 기관 커뮤니케이션에 관한 사회과학 연구를 가능하게 한다.
As COVID-19 quickly became one of the most concerned global crisis, the demand for data in academic research is also increasing. Currently, there are several open access Twitter datasets, but none of them is dedicated to the institutional and news media Twitter data collection, to fill this blank, we retrieved data from 69 institutional/news media Twitter accounts, 17 of them were related to government and international organizations, 52 of them were news media across North America, Europe and Asia. We believe our open access data can provide researchers more availability to conduct social science research.
연구 동기 및 목표
- 코로나19 팬데믹 기간 동안 기관 및 뉴스 미디어 계정에 집중된 전용 오픈 액세스 트위터 데이터셋의 부족을 보완하기 위해.
- 글로벌 보건 위기 기간 동안 미디어 및 기관 커뮤니케이션 패턴을 연구할 수 있도록 연구자들에게 신뢰할 수 있고 공개된 데이터셋을 제공하기 위해.
- 공신력 있는 출처에서 수집한 정제된 데이터셋을 제공함으로써 정보 확산, 공중보건 메시징, 미디어 프레임에 관한 사회과학 연구를 지원하기 위해.
- 다양한 지역 및 조직 유형이 소셜 미디어에서 팬데믹에 대해 어떻게 커뮤니케이션했는지 비교 분석을 가능하게 하기 위해.
- 명확한 문서화 및 메타데이터를 제공함으로써 연구의 재현 가능성을 확보하기 위해 데이터셋을 공개하기 위해.
제안 방법
- 트위터 API를 사용하여 69개의 기관 및 뉴스 미디어 트위터 계정에서 트윗을 수집하였다.
- 공중보건, 정부, 국제기구와 관련된 계정을 선정하였으며, 북미, 유럽, 아시아의 주요 뉴스 매체를 포함하였다.
- 팬데믹 초기 단계에 해당하는 데이터를 확보하기 위해 2020년 3월에서 4월 사이의 콘텐츠에 집중하였다.
- 메타데이터, 타임스탬프, 콘텐츠 구조의 일관성을 확보하기 위해 데이터셋을 정리하고 청소하였다.
- 학술적 재사용과 재현 가능성을 지원하기 위해 오픈 액세스 라이선스 하에 데이터셋을 공개하였다.
- 데이터 수집 절차, 계정 선정 기준, 메타데이터 스키마에 대한 문서화를 제공하여 투명성과 사용성을 확보하였다.
실험 결과
연구 질문
- RQ1팬데믹 초기 단계 동안 기관 및 뉴스 미디어 계정은 트위터에서 코로나19를 어떻게 프레임화하였는가?
- RQ2정부/보건 기관과 뉴스 미디어 기관 간의 커뮤니케이션 전략에 어떤 차이가 있었는가?
- RQ3미디어 보도의 지역적 차이가 소셜 미디어에서의 정보 유포에 어떤 영향을 미쳤는가?
- RQ4공중보건 지침, 뉴스 초점, 인포그래픽 등 어떤 유형의 콘텐츠가 기관 및 뉴스 미디어 계정에서 가장 자주 공유되었는가?
- RQ5기관 트윗의 수와 시간적 배포가 공중보건 이벤트 또는 정책 발표와 어떤 관련이 있었는가?
주요 결과
- 데이터셋은 정부 및 국제기구 계정 17개와 뉴스 미디어 기관 52개를 포함한 총 69개의 기관 및 뉴스 미디어 트위터 계정을 포함한다.
- 데이터셋은 북미, 유럽, 아시아를 포함한 다양한 지리적 지역을 포함하여 다각도적 비교를 가능하게 한다.
- 트윗은 2020년 3월에서 4월 사이에 수집되었으며, 팬데믹 관련 커뮤니케이션의 초반 단계를 반영한다.
- 타임스탬프, 트윗 텍스트, 계정 유형 등의 구조화된 메타데이터를 포함하여 콘텐츠와 시간적 특성에 대한 세밀한 분석을 지원한다.
- arXiv와 함께 공개된 데이터셋은 재현 가능성과 학술적 재사용을 지원하기 위한 문서화 자료를 포함한다.
- 이 데이터셋은 글로벌 보건 위기 기간 동안 공신력 있는 기관 및 미디어 자료에 집중된 오픈 액세스 소셜 미디어 데이터의 핵심적 부족을 메운다.
더 나은 연구,지금 바로 시작하세요
논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.
카드 등록 없음 · 무료 플랜 제공
이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.