Skip to main content
QUICK REVIEW

[논문 리뷰] Determination of the Internet Anonymity Influence on the Level of Aggression and Usage of Obscene Lexis

Rodmonga Potapova, Denis Gordeev|arXiv (Cornell University)|2015. 10. 01.
Hate Speech and Cyberbullying Detection참고 문헌 3인용 수 3
한 줄 요약

이 연구는 러시아어 및 영어 사용 익명 포럼(2ch.hk, iichan.hk, 4chan.org)과 익명이 아닌 VK 커뮤니티(MDK)에서 인터넷 익명성이 공격성과 저속어 사용에 미치는 영향을 분석한다. 파이썬과 NLTK를 활용한 콘텐츠 분석 및 자연어처리 도구를 사용하여, 익명성과 공격성 또는 저속어 증가 간 유의미한 상관관계는 발견되지 않았으며, 메시지의 12.5%만이 공격성을 보였고, 저속어 사용의 60.4%는 공격성과 관련이 없었다. 모더레이션은 저속어 사용을 뚜렷이 감소시켰으며, 이는 플랫폼 정책이 익명성 자체보다 더 중요한 영향을 미친다는 것을 시사한다.

ABSTRACT

This article deals with the analysis of the semantic content of the anonymous Russian-speaking forum 2ch.hk, different verbal means of expressing of the emotional state of aggression are revealed for this site, and aggression is classified by its directions. The lexis of different Russian-and English- speaking anonymous forums (2ch.hk and iichan.hk, 4chan.org) and public community "MDK" of the Russian-speaking social network VK is analyzed and compared with the Open Corpus of the Russian language (Opencorpora.org and Brown corpus). The analysis shows that anonymity has no influence on the amount of invective items usage. The effectiveness of moderation was shown for anonymous forums. It was established that Russian obscene lexis was used to express the emotional state of aggression only in 60.4% of cases for 2ch.hk. These preliminary results show that the Russian obscene lexis on the Internet does not have direct dependence on the emotional state of aggression.

연구 동기 및 목표

  • 인터넷 익명성이 온라인 포럼에서 공격성과 저속어 사용을 증가시키는지 조사하기.
  • 익명(2ch.hk, iichan.hk, 4chan.org)과 익명이 아닌(VK/MDK) 플랫폼 간 공격성 및 저속어 사용의 언어적 패턴을 비교하기.
  • 모더레이션의 효과가 저속어 사용과 공격적 표현 감소에 얼마나 기여하는지 평가하기.
  • 저속어 어휘가 주로 공격성을 표현하기 위해 사용되는지, 아니면 다른 언어적 기능을 위해 사용되는지 판단하기.
  • 디지털 대화에서 공격성을 탐지하기 위한 자동화된 도구 개발에 기여하기.

제안 방법

  • 2015년 1월에 수집된 2ch.hk에서 114,275건, iichan.hk에서 29,134건, VK/MDK에서 3,556건, 4chan.org에서 2,656건의 메시지에 대한 콘텐츠 분석.
  • 파이썬 2.7과 NLTK 라이브러리를 사용한 텍스트 파싱, 단어 빈도 수세기, 정지어 필터링.
  • 러시아어 오픈 코퍼스(Opencorpora.org)와 영어 브라운 코퍼스 대비 포럼 코퍼스의 단어 빈도 비교.
  • 메시지의 공격성 유형(민족, 정치, 사회 등)과 저속어의 언어적 기능에 대한 수동 분류.
  • 레빈의 분류 체계를 적용하여 비공격적 저속어 사용 유형(예: 감탄사, 대명사, 동사 대체어 등) 분류.
  • 플랫폼 간 평균 문장 길이, 저속어 빈도, 공격성 표시어의 빈도에 대한 정량적 분석.

실험 결과

연구 질문

  • RQ1인터넷 익명성이 온라인 포럼에서 저속어 사용과 공격적 표현 증가에 유의미하게 기여하는가?
  • RQ2익명과 익명이 아닌 온라인 커뮤니티 간 저속어 사용 빈도와 공격성 빈도는 어떻게 다를까?
  • RQ3레빈의 분류 체계에 따르면, 익명 포럼에서 저속어의 비공격적 언어적 기능은 무엇인가?
  • RQ4모더레이션이 저속어 사용과 공격적 논의 감소에 어느 정도 기여하는가?
  • RQ5익명성과 디지털 커뮤니케이션의 전체적인 공격성 수준 간 측정 가능한 상관관계가 존재하는가?

주요 결과

  • 익명성이 저속어 사용 비율이나 공격성 증가에 유의미하게 기여하지 않으며, 2ch.hk에서 메시지의 12.5%만이 공격성을 포함했고, 저속어 사용의 60.4%는 공격성과 관련이 없었다.
  • 익명이 아닌 VK/MDK 커뮤니티에서는 익명 포럼보다 저속어 사용 비율이 1.5배 높았으며, 이는 익명성이 저속어 사용의 주요 원인이 아님을 시사한다.
  • iichan.hk에서의 모더레이션은 저속어 사용을 뚜렷이 감소시켰으며, 이는 플랫폼 수준의 정책이 익명성 자체보다 더 큰 영향을 미친다는 것을 시사한다.
  • 저속어는 자주 비공격적으로 사용되었으며, 감탄사(12.5%), 무감정 표현, 감정이 없는 삽입어, 대명사, 동사 대체어(예: 영어에서의 'f*ck') 등으로 사용되었다.
  • 공격성은 주로 개인을 향해 향했으며(예: 'школьник'으로 인한 비하), 정치적·민족적 공격성은 덜 흔하지만 여전히 존재했다.
  • 공격성의 언어적 메커니즘은 어휘적 저속어 외에도 어구적 표현, 어형 변화(혼합, 접두어 부착), 문법적 구조(명령문, 명제 문장)를 포함하며, 단지 어휘적 저속어만으로는 설명되지 않는다.

더 나은 연구,지금 바로 시작하세요

논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.

카드 등록 없음 · 무료 플랜 제공

이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.