Skip to main content
QUICK REVIEW

[논문 리뷰] A Longitudinal Measurement Study of 4chan's Politically Incorrect Forum and its Effect on the Web.

Gabriel Emile Hine, Jeremiah Onaolapo|arXiv (Cornell University)|2016. 10. 11.
Hate Speech and Cyberbullying Detection참고 문헌 14인용 수 12
한 줄 요약

이 논문은 4ch의 /pol/ 포럼에 대한 최초의 종단적 측정 연구를 제시하며, 2.5개월 동안 800만 건이 넘는 게시물을 분석하여 글로벌 사용자 분포, 콘텐츠 패턴, 그리고 소셜미디어에 대한 조작된 공격을 규명한다. 연구 결과 /pol/은 광범위한 혐오 발언과 유튜브 링크 공유를 주도하고 있으며, 이미지 반복은 최소한이지만 언어적 혼동 전략을 통해 반트롤 도구를 속이는 데도 제한적인 성공을 거두고 있음을 확인한다.

ABSTRACT

The discussion board site 4chan has been a part of the dark underbelly of the Internet since its inception, but recent events have brought it to the forefront of the world's collective mind. In particular, /pol/, 4chan's Politically Incorrect board has become a central figure in the outlandish 2016 US election campaign, often linked to the alt-right movement and the rhetoric of hate and racism. Nonetheless, 4chan remains relatively unstudied by the research community. In this paper, we start addressing this gap by analyzing /pol/ along several axes, using a dataset of over 8M posts collected over two and a half months. First, we perform a general characterization, showing that /pol/ users are well distributed around the world and that 4chan's unique features encourage fresh discussions. Then, we analyze content posted on /pol/, finding YouTube links and hate speech to be predominant, that 95\% of images are posted no more than 5 times, and that there are notable differences in the English language used in different parts of the world. Last but not least, we provide quantitative evidence of /pol/'s collective attacks on other social media platforms by analyzing the comments in YouTube videos linked on /pol/. We also present a quantitative case study of /pol/'s attempt to poison anti-trolling tools by altering the language of hate on social media, finding it to be less successful than reported by the popular press. Overall, our analysis not only provides the first measurement study of /pol/, but also insight on online harassment and hate speech trends in online social media.

연구 동기 및 목표

  • 4chan의 정치적으로 올바르지 않은 포럼인 /pol/에 대한 경험적 연구의 부족을 해결하고자 하며, 이는 온라인 극단주의와 2016년 미국 선거 논의에서 중요한 역할을 해왔다.
  • /pol/ 사용자의 글로벌 분포와 언어 다양성을 분석하여, 4chan의 구조적 특징이 어떻게 새로운 토론을 촉진하는지 평가하고자 한다.
  • /pol/에서의 혐오 발언, 유튜브 링크 공유, 이미지 재사용의 빈도를 조사하여 콘텐츠 동역학을 이해하고자 한다.
  • 특히 유튜브를 포함한 외부 플랫폼에 대한 /pol/의 조작된 공격, 즉 댓글 스팮밍을 정량적으로 측정하고자 한다.
  • 언어적 혼동 전략이 자동 반트롤 도구를 회피하는 데 얼마나 효과적인지 평가하며, 대중 매체에서 제기된 성공 주장에 도전하고자 한다.

제안 방법

  • 웹 스크래핑과 API 기반 접근을 통해 2.5개월 동안 /pol/에서 800만 건이 넘는 게시물의 종단적 데이터셋을 수집하였다.
  • 게시물의 지리적 위치와 언어 분석을 수행하여 사용자 분포를 매핑하고 영어 사용의 지역적 변동성을 파악하였다.
  • 자연어 처리(NLP) 기법을 사용하여 혐오 발언을 탐지하고, 콘텐츠 유형(예: 유튜브 링크 포함 여부)을 분류하였다.
  • 이미지 빈도 분포를 분석하여 재사용 패턴을 평가하였으며, 95%의 이미지가 다섯 번 이하로 공유됨을 발견하였다.
  • /pol/에 링크된 유튜브 영상의 댓글을 추적하여, 조작된 다운보팅 및 괴롭힘 캠페인의 정도를 측정하였다.
  • 언어 변형 전후의 반트롤 도구 탐지율을 비교하여 언어적 혼동 전략의 효과를 평가하였다.

실험 결과

연구 질문

  • RQ1/pol/의 지리적 분포는 어떠한가? 그리고 4chan의 구조적 특징이 새로운 토론을 유지하는 데 어떤 역할을 하는가?
  • RQ2/pol/에서 지배적인 콘텐츠 유형은 무엇인가? 특히 혐오 발언, 유튜브 링크, 이미지 공유 측면에서 설명하고자 한다.
  • RQ3/pol/이 댓글 스팸을 통해 외부 플랫폼, 특히 유튜브에 대해 얼마나 조직적으로 공격하는가?
  • RQ4/pol/에서 사용되는 언어적 혼동 기법이 자동 반트롤 도구를 회피하는 데 얼마나 효과적인가?
  • RQ5/pol/에서 관찰되는 영어 사용의 지역적 언어적 차이는 글로벌 사용자 다양성을 어떻게 반영하는가?

주요 결과

  • /pol/ 사용자는 전 세계적으로 잘 분포되어 있어 국지적 현상이 아니라 세계적인 사용자 기반을 지닌 것으로 나타났다.
  • 혐오 발언과 유튜브 링크는 /pol/에서 가장 지배적인 콘텐츠 유형으로, 포럼의 논의를 지배하고 있다.
  • /pol/에 게시된 이미지의 95%는 다섯 번 이하로 공유되며, 이는 이미지 재사용이 적고 콘텐츠의 신선도가 높다는 것을 시사한다.
  • 지역 간 영어 사용에 상당한 언어적 차이가 관찰되어 다양한 사용자 기원을 반영하고 있다.
  • /pol/에서 링크된 유튜브 댓글에 대한 조작된 공격은 정량적으로 측정 가능했으며, 조직적인 괴롭힘 캠페인이 존재함을 시사한다.
  • 언어적 혼동 전략이 대중 매체에서 제기한 것만큼 반트롤 도구를 회피하는 데 효과적이지 않았으며, 탐지율은 여전히 높았다.

더 나은 연구,지금 바로 시작하세요

논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.

카드 등록 없음 · 무료 플랜 제공

이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.