[논문 리뷰] What are Your Pronouns? Examining Gender Pronoun Usage on Twitter
이 연구는 2020–2021년 기간 동안 수집된 20억 건이 넘는 트위터 트윗 데이터셋을 활용하여 트위터에서 성별 대명사 자가공개 현상을 분석한다. 연구 결과, 대명사 사용이 증가하고 있으며, 특히 she계열과 비이원성 대명사에서 두드러진다. 사회적 네트워크를 통한 대명사 공개 노출이 향후 대명사 사용에 큰 영향을 미치며, 비이원성 대명사 사용에 특히 두드러진다. 이는 소셜 미디어에서 성중립적 언어를 장려하는 데 있어 사회적 영향력의 중요성을 보여준다.
Stating your gender pronouns, along with your name, is becoming the new norm of self-introductions at school, at the workplace, and online. The increasing prevalence and awareness of nonconforming gender identities put discussions of developing gender-inclusive language at the forefront. This work presents the first empirical research on gender pronoun usage on large-scale social media. Leveraging a Twitter dataset of over 2 billion tweets collected continuously over two years, we find that the public declaration of gender pronouns is on the rise, with most people declaring as using she series pronouns, followed by he series pronouns, and a smaller but considerable amount of non-binary pronouns. From analyzing Twitter posts and sharing activities, we can discern users who use gender pronouns from those who do not and also distinguish users of various gender identities. We further illustrate the relationship between explicit forms of social network exposure to gender pronouns and their eventual gender pronoun adoption. This work carries crucial implications for gender-identity studies and initiates new research directions in gender-related fairness and inclusion, as well as support against online harassment and discrimination on social media.
연구 동기 및 목표
- 사용자 프로필에서 성별 대명사 자가공개의 빈도와 추세를 시간 경과에 따라 이해하는 것.
- 사용자가 성별 대명사를 향후 사용하는 데 있어 사회적 네트워크 노출이 영향을 미치는지 조사하는 것.
- 사용자 프로필과 온라인 행동에서 성별 대명사 유형을 자동으로 식별하는 방법을 개발하고 검증하는 것.
- she계열, he계열, 비이원성 대명사 사용자 간의 채택 패턴의 차이를 분석하는 것.
- 사회적 영향력 메커니즘을 통해 온라인 플랫폼에서 성중립성을 증진하기 위한 실질적 통찰을 제공하는 것.
제안 방법
- 코로나19 패닉 기간 동안 수집된 20억 건이 넘는 트윗을 포함한 대규모 종단적 트위터 데이터셋을 활용하였다.
- 자연어 처리 및 패턴 기반 분류 기법을 사용하여 사용자 프로필과 트윗에서 성별 대명사(예: she, he, they, xe, ze 등)를 탐지하고 분류하였다.
- 다른 사용자가 공개적으로 자신의 대명사를 밝힐 경우의 상호작용 빈도를 측정하여 사회적 네트워크 노출 지표를 구축하였다.
- 과거의 대명사 공개 노출과 향후 대명사 사용 간의 인과관계를 평가하기 위해 종단적 모델링을 적용하였다.
- 결과의 신뢰성을 강화하기 위해 타커와 존스(2022)의 병행 연구를 활용하여 결과를 검증하였다.
- LGBTQ+ 사용자를 보호하기 위해 응집 분석 및 원시 데이터 또는 개인 레이블의 공개를 방지하는 윤리적 보호 조치를 시행하였다.
실험 결과
연구 질문
- RQ1시간이 지남에 따라 트위터 사용자 프로필에서 성별 대명사 사용의 빈도는 어떠한가?
- RQ2사용자의 소셜 미디어 행동을 기반으로 사용자의 프로필에 존재하는 성별 대명사의 종류를 자동으로 식별할 수 있는가?
- RQ3과거의 사회적 네트워크 노출을 통해 대명사 사용을 자동으로 식별할 수 있는가?
- RQ4다른 대명사 유형의 공개 노출이 향후 대명사 사용에 어떤 영향을 미치는가?
- RQ5비이원성 대명사 사용자가 네트워크 내에서 다른 사용자의 대명사 사용에 특별히 영향을 미치는가?
주요 결과
- 2020년에서 2021년 사이에 트위터 사용자 중 자신의 선호하는 대명사를 공개하는 비율이 33% 증가했지만, 전체 사용자의 8% 미만에 그친다.
- she계열 대명사는 600만 건의 트윗에서 사용되었으며, he계열 사용자의 300만 건을 초과하여 여성성 대명사가 더 높은 시각적 존재감과 사용 빈도를 보였다.
- 비이원성 대명사는 160만 건의 트윗에서 공개되었으며, 다소 낮지만 여전히 의미 있는 존재감을 보였다.
- 다른 사용자가 대명사를 공개하는 데 노출된 정도가 높은 사용자는 향후 대명사를 사용할 가능성이 뚜렷이 높았다. 특히 비이원성 대명사 사용자에 대한 노출이 가장 두드러진 영향을 보였다.
- 비이원성 대명사 사용자는 비례에 비해 더 큰 영향력을 행사했다. 사용자의 네트워크 내에서 비이원성 대명사 사용자가 존재할 경우, 비이원성 대명사 사용의 채택과 가장 강하게 연관되어 있었다.
- 본 연구는 사회적 네트워크 노출이 대명사 사용 채택의 핵심 요인임을 확인하였으며, 동료 사용자의 행동을 통해 대명사 사용이 시각화되고 정규화됨으로써 성중립적 언어가 장려된다는 점을 시사한다.
더 나은 연구,지금 바로 시작하세요
논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.
카드 등록 없음 · 무료 플랜 제공
이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.