[논문 리뷰] Corrupted by Algorithms? How AI-generated and Human-written Advice Shape (Dis)honesty
연구는 AI(생성) 조언과 인간이 작성한 조언이 부정직 및 정직한 행동에 어떠한 영향을 미치는지 조사하며, 부정직을 촉진하는 조언은 출처에 관계없이 부정직을 증가시키고, 조언 출처에 대한 투명성은 효과가 없다는 것을 발견했다.
Artificial Intelligence (AI) increasingly becomes an indispensable advisor. New ethical concerns arise if AI persuades people to behave dishonestly. In an experiment, we study how AI advice (generated by a Natural-Language-Processing algorithm) affects (dis)honesty, compare it to equivalent human advice, and test whether transparency about advice source matters. We find that dishonesty-promoting advice increases dishonesty, whereas honesty-promoting advice does not increase honesty. This is the case for both AI- and human advice. Algorithmic transparency, a commonly proposed policy to mitigate AI risks, does not affect behaviour. The findings mark the first steps towards managing AI advice responsibly.
연구 동기 및 목표
- AI를 조언 에이전트로서의 윤리적 및 행동적 위험에 대한 이해를 촉진한다.
- AI 생성 조언의 행동적 영향을 동등한 인간 조언과 비교한다.
- 조언 출처에 대한 투명성이 비정직 또는 정직으로의 변화를 완화하는지 테스트한다.
제안 방법
- AI 생성 조언 또는 인간이 작성한 조언에 참가자를 노출하는 실험을 수행한다.
- 비정직을 조장하거나 정직을 촉진하는 조언의 유형을 조작한다.
- 조언 출처에 대한 투명성 조건을 포함하고 이후 행동을 측정한다.
- AI와 인간 조언 간 효과를 비교하여 출처별 패턴을 식별한다.
실험 결과
연구 질문
- RQ1AI 생성 조언은 인간이 작성한 비정직을 촉진하는 조언만큼 비정직을 촉진하는가?
- RQ2정직을 촉진하는 조언이 조언의 출처에 관계없이 정직한 행동을 증가시키는가?
- RQ3조언이 AI 생성 여부에 대한 투명성이 행동에 영향을 미치는가?
- RQ4출처(AI vs. 인간)에 따른 비정직-대정직 촉진 조언에 대한 반응에 차이가 있는가?
주요 결과
- 비정직을 조장하는 조언은 비정직한 행동을 증가시킨다.
- 정직을 촉진하는 조언은 정직을 증가시키지 않는다.
- 조언 출처에 대한 투명성은 행동에 영향을 미치지 않는다.
- 효과는 AI 생성 조언과 인간이 작성한 조언 모두에서 관찰된다.
더 나은 연구,지금 바로 시작하세요
논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.
카드 등록 없음 · 무료 플랜 제공
이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.