Skip to main content
QUICK REVIEW

[論文レビュー] Determination of the Internet Anonymity Influence on the Level of Aggression and Usage of Obscene Lexis

Rodmonga Potapova, Denis Gordeev|arXiv (Cornell University)|Oct 1, 2015
Hate Speech and Cyberbullying Detection参考文献 3被引用数 3
ひとこと要約

本研究は、ロシア語圏および英語圏の匿名フォーラム(2ch.hk、iichan.hk、4chan.org)と非匿名のVKコミュニティ(MDK)におけるインターネット匿名性が攻撃性および不穏な語彙使用に与える影響を分析する。コンテンツ分析とNLPツール(Python、NLTK)を用いた結果、匿名性と攻撃的言語や不穏な語彙の増加との間に有意な相関は認められず、メッセージのうち12.5%しか攻撃的でなく、不穏な語彙使用の60.4%は攻撃的でない。モデレーションは不穏な言葉の使用を顕著に減少させ、匿名性そのものよりもプラットフォームのポリシーが重要であることが示唆された。

ABSTRACT

This article deals with the analysis of the semantic content of the anonymous Russian-speaking forum 2ch.hk, different verbal means of expressing of the emotional state of aggression are revealed for this site, and aggression is classified by its directions. The lexis of different Russian-and English- speaking anonymous forums (2ch.hk and iichan.hk, 4chan.org) and public community "MDK" of the Russian-speaking social network VK is analyzed and compared with the Open Corpus of the Russian language (Opencorpora.org and Brown corpus). The analysis shows that anonymity has no influence on the amount of invective items usage. The effectiveness of moderation was shown for anonymous forums. It was established that Russian obscene lexis was used to express the emotional state of aggression only in 60.4% of cases for 2ch.hk. These preliminary results show that the Russian obscene lexis on the Internet does not have direct dependence on the emotional state of aggression.

研究の動機と目的

  • インターネット匿名性がオンラインフォーラムにおける攻撃性および不穏な語彙使用を増加させるかどうかを調査すること。
  • 匿名(2ch.hk、iichan.hk、4chan.org)と非匿名(VK/MDK)のプラットフォーム間で、攻撃的言語および不穏な語彙の言語的パターンを比較すること。
  • モデレーションが不穏な言語および攻撃的表現の削減にどの程度効果的であるかを評価すること。
  • 不穏な語彙が攻撃的表現のためのものであるか、それとも他の言語的機能のために使われるかを特定すること。
  • デジタルディス course における攻撃的言語の検出に向けた自動化ツールの開発に貢献すること。

提案手法

  • 2015年1月に収集された、2ch.hkから114,275件、iichan.hkから29,134件、VK/MDKから3,556件、4chan.orgから2,656件のメッセージを対象としたコンテンツ分析。
  • Python 2.7とNLTKライブラリを用いたテキスト解析、語彙頻度のカウント、ストップワードフィルタリング。
  • ロシア語のオープンコーパス(Opencorpora.org)および英語のBrownコーパスと比較して、フォーラムコーパス内の語彙頻度を分析。
  • 攻撃の種別(民族的、政治的、社会的など)および不穏な語彙の言語的機能ごとに、手動でメッセージを分類。
  • Levinの分類法を応用し、攻撃的でない用途(例:感嘆詞、代名詞、動詞の代替語など)を分類。
  • 平均発話単語数、不穏な語彙の頻度、攻撃的兆候の頻度を、各プラットフォーム間で定量的に比較分析。

実験結果

リサーチクエスチョン

  • RQ1インターネット匿名性は、オンラインフォーラムにおける不穏な語彙使用および攻撃的表現の増加を顕著に促進するか?
  • RQ2匿名と非匿名のオンラインコミュニティ間で、不穏な語彙および攻撃的言語の頻度はどのように異なるか?
  • RQ3Levinの分類法に従い、匿名フォーラムにおける不穏な語彙の非攻撃的言語的機能は何か?
  • RQ4モデレーションは、不穏な言語および攻撃的ディス course の使用をどの程度減少させるか?
  • RQ5匿名性とデジタルコミュニケーション全体における攻撃的レベルの間には、測定可能な相関関係があるか?

主な発見

  • 匿名性が不穏な語彙や攻撃的言語の使用割合を顕著に増加させない。2ch.hkではメッセージのうち12.5%しか攻撃的ではなく、不穏な語彙使用の60.4%は攻撃的でない。
  • 非匿名のVK/MDKコミュニティでは、匿名フォーラムよりも不穏な語彙使用の割合が1.5倍高い(1.5倍高い)ため、匿名性が不穏な言葉の使用の主因ではないことが示唆された。
  • iichan.hkにおけるモデレーションは不穏な言語使用を顕著に減少させた。これは、プラットフォームレベルのポリシーが匿名性そのものよりも影響力が大きいことを示している。
  • 不穏な語彙は頻繁に攻撃的でない目的で使われていた:感嘆詞(12.5%)、無関心の表現、感情的負荷のない挿入語、代名詞、動詞の代替語(例:英語の「f*ck」)。
  • 攻撃的言語は主に個人を標的にしていた(例:「しょがくじん」を侮辱として使用)。政治的・民族的攻撃はそれほど頻度は高くないが、依然として存在した。
  • 攻撃的言語の言語的メカニズムには、熟語的表現、語幹形成(合成語、接尾語付け)、文法的構造(命令文、名詞句のみの文)が含まれ、単なる語彙的不穏語に依存するわけではない。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。