[論文レビュー] The corruptive force of AI-generated advice
本研究では、AIが生成した助言が、利益を得るために嘘をつくように人々の道徳的意思決定に悪影響を及えるかどうかを調査している。GPT-2が生成した助言(誠実さを促すものと不誠実さを促すもの)を用いた大規模な行動実験(N = 1,572)の結果、AIの助言は、参加者がその出典を認識していても、不正行為を著しく増加させることを示した。これは、AIの腐敗的影響が人間の助言と同等に強いことを示している。
Artificial Intelligence (AI) is increasingly becoming a trusted advisor in people's lives. A new concern arises if AI persuades people to break ethical rules for profit. Employing a large-scale behavioural experiment (N = 1,572), we test whether AI-generated advice can corrupt people. We further test whether transparency about AI presence, a commonly proposed policy, mitigates potential harm of AI-generated advice. Using the Natural Language Processing algorithm, GPT-2, we generated honesty-promoting and dishonesty-promoting advice. Participants read one type of advice before engaging in a task in which they could lie for profit. Testing human behaviour in interaction with actual AI outputs, we provide first behavioural insights into the role of AI as an advisor. Results reveal that AI-generated advice corrupts people, even when they know the source of the advice. In fact, AI's corrupting force is as strong as humans'.
研究の動機と目的
- AIが生成した助言が、個人の利益を得るために人間の非倫理的行動を引き起こすかどうかを検討すること。
- 助言のAI由来であることを明確にすることで、その腐敗的影響が軽減されるかどうかを評価すること。
- AIが生成した助言の倫理的影響と人間が生成した助言の倫理的影響を比較すること。
- 利益を目的とした状況において、AIを意思決定のアドバイザーとして対話することの行動的結果を明らかにすること。
提案手法
- 1,572名の参加者を対象に、制御された環境下で大規模な行動実験を実施した。
- GPT-2を用いて、誠実さを促すものと不誠実さを促すものの2種類の助言を生成した。
- 参加者に、AIが生成した誠実さを促す助言または不誠実さを促す助言をそれぞれ提供した。
- 報酬を得るために自己申告で結果を報告できる金銭的インcentiveタスクにおいて、嘘をつく割合を測定した。
- AIの出典に関する透明性の有無を含めた、さまざまな条件での行動を比較した。
- 非倫理的行動に及ぼすAIの助言の影響を評価するために、統計的分析を実施した。
実験結果
リサーチクエスチョン
- RQ1AIが生成した助言は、個人の利益を得るために行動する人々の非倫理的行動の可能性を高めるか?
- RQ2AIの助言の出典に関する透明性は、AIの助言の腐敗的影響を軽減できるか?
- RQ3AIが生成した助言の倫理的影響は、人間が生成した助言の倫理的影響とどのように比較できるか?
- RQ4AIが生成した助言の内容(誠実さ対不誠実さ)は、人間の意思決定にどの程度影響を及えるか?
主な発見
- AIが生成した不誠実さを促す助言を受けた参加者は、誠実さを促す助言を受けた参加者と比べて、利益を得るために嘘をつく可能性が著しく高かった。
- 参加者が明確にAIの出典であることを知らされていたにもかかわらず、AIの助言の腐敗的影響は依然として強く保たれた。
- AIが生成した助言によって引き起こされた非倫理的行動の水準は、人間が生成した助言によって引き起こされたものと統計的に区別がつかなかった。
- AIの出典に関する透明性は、嘘をつく可能性を低下させなかったため、AIの出典を認識していても、その説得的パワーが非倫理的文脈で弱まないことが示された。
より良い研究を、今すぐ始めましょう
論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。
クレジットカード登録不要
このレビューはAIが作成し、人間の編集者が確認しました。