[論文レビュー] A Longitudinal Measurement Study of 4chan's Politically Incorrect Forum and its Effect on the Web.
本論文は、4chの/pol/フォーラムにおける縦断的測定調査を初めて実施し、2.5か月間にわたり800万件を超える投稿を分析することで、グローバルなユーザー分布、コンテンツパターン、およびソーシャルメディアへの標的攻撃を特徴づけた。/pol/は広範な嫌がらせ発言とYouTubeリンク共有を促進しているが、画像の繰り返しはほとんどなく、言語的曇渡しによる反トロールツールのねじれにも限定的な成功を示していることがわかった。
The discussion board site 4chan has been a part of the dark underbelly of the Internet since its inception, but recent events have brought it to the forefront of the world's collective mind. In particular, /pol/, 4chan's Politically Incorrect board has become a central figure in the outlandish 2016 US election campaign, often linked to the alt-right movement and the rhetoric of hate and racism. Nonetheless, 4chan remains relatively unstudied by the research community. In this paper, we start addressing this gap by analyzing /pol/ along several axes, using a dataset of over 8M posts collected over two and a half months. First, we perform a general characterization, showing that /pol/ users are well distributed around the world and that 4chan's unique features encourage fresh discussions. Then, we analyze content posted on /pol/, finding YouTube links and hate speech to be predominant, that 95\% of images are posted no more than 5 times, and that there are notable differences in the English language used in different parts of the world. Last but not least, we provide quantitative evidence of /pol/'s collective attacks on other social media platforms by analyzing the comments in YouTube videos linked on /pol/. We also present a quantitative case study of /pol/'s attempt to poison anti-trolling tools by altering the language of hate on social media, finding it to be less successful than reported by the popular press. Overall, our analysis not only provides the first measurement study of /pol/, but also insight on online harassment and hate speech trends in online social media.
研究の動機と目的
- /pol/、4chの政治的に不正確なフォーラムについて、実証的研究が不足していることに対処する。このフォーラムはオンライン極端主義や2016年米国大統領選挙の議論において重要な役割を果たしている。
- 4chの構造的特徴がどのように新規議論を促進するかを評価するため、/pol/ユーザーのグローバルな分布と言語的多様性を分析する。
- 嫌がらせ発言、YouTubeリンク共有、画像再利用の頻度を調査し、コンテンツのダイナミクスを理解する。
- コメントスパムによる外部プラットフォーム、特にYouTubeへの標的攻撃の程度を定量化する。
- メディア報道で主張されている成功を裏付けるように、言語的曇渡しが自動反トロールツールを回避する効果を評価する。
提案手法
- WebスクレイピングおよびAPIアクセスを用いて、2.5か月間にわたり800万件を超える/post/の縦断的データセットを収集した。
- 投稿の位置特定と言語分析を実施し、ユーザー分布をマップし、英語使用における地域的差異を同定した。
- 自然言語処理(NLP)技術を用いて嫌がらせ発言を検出・分類し、YouTubeリンクの頻度を含むコンテンツタイプを特定した。
- 画像の頻度分布を分析し、再利用パターンを評価した。その結果、投稿された画像の95%が5回以下しか再利用されていないことが判明した。
- /pol/でリンクされたYouTube動画のコメントを追跡し、標的的な低評価やいじめキャンペーンの程度を測定した。
- 言語的曇渡し戦略の有効性を評価するため、/pol/での言語操作前後における反トロールツールの検出率を比較した。
実験結果
リサーチクエスチョン
- RQ1/pol/のユーザーは地理的にどのように分布しているのか。また、4chの構造的特徴は、新規議論を維持するために果たす役割は何か。
- RQ2/pol/で支配的となっているコンテンツの種類は何か。特に嫌がらせ発言、YouTubeリンク、画像共有の観点から。
- RQ3/pol/は、コメントスパムによって外部プラットフォーム、特にYouTubeに対してどれほど標的攻撃を実施しているか。
- RQ4/pol/で用いられる言語的曇渡し技術は、自動反トロールツールを回避するためにどれほど効果的か。
- RQ5/pol/における英語の地域的言語的差異は、グローバルユーザーの多様性をどのように反映しているか。
主な発見
- /pol/のユーザーは世界中に広く分布しており、地域的現象ではなく、国際的なユーザー基盤を有していることが示された。
- 嫌がらせ発言とYouTubeリンクが/pol/で最も顕著なコンテンツタイプであり、フォーラム全体の議論を支配している。
- /pol/に投稿された画像の95%が5回以下しか再利用されていないため、画像の再利用は少なく、コンテンツの新鮮さが高いことが示された。
- 地理的地域ごとの英語使用に顕著な言語的差異が観察され、ユーザーの多様なルーツが反映されている。
- /pol/からリンクされたYouTubeのコメントに対する標的的な低評価やいじめキャンペーンは、定量的に測定可能であり、組織的ないじめキャンペーンの存在を示している。
- メディア報道で主張されているほどではなく、/pol/における言語的曇渡しは反トロールツールの回避に効果が低く、検出率は依然として高い水準を維持していた。
より良い研究を、今すぐ始めましょう
論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。
クレジットカード登録不要
このレビューはAIが作成し、人間の編集者が確認しました。