Skip to main content
QUICK REVIEW

[論文レビュー] The Virtuous Machine - Old Ethics for New Technology?

Nicolas Berberich, Klaus Diepold|arXiv (Cornell University)|Jun 27, 2018
Ethics and Social Impacts of AI参考文献 15被引用数 8
ひとこと要約

本論文は、アリストテレス的徳目倫理学が道徳的人工知能を設計する強固な基盤を提供すると提案している。模倣学習による道徳的模範からの学習が価値整合性問題を解決でき、自己改善への無制限の欲求を排除するため、節制や友愛といった徳目が制御問題を防ぐ。主な貢献は、経験的自己形成を通じて道徳的行動を学ぶAIを構築するフレームワークであり、人間の受容性と安全性を高める。

ABSTRACT

Modern AI and robotic systems are characterized by a high and ever-increasing level of autonomy. At the same time, their applications in fields such as autonomous driving, service robotics and digital personal assistants move closer to humans. From the combination of both developments emerges the field of AI ethics which recognizes that the actions of autonomous machines entail moral dimensions and tries to answer the question of how we can build moral machines. In this paper we argue for taking inspiration from Aristotelian virtue ethics by showing that it forms a suitable combination with modern AI due to its focus on learning from experience. We furthermore propose that imitation learning from moral exemplars, a central concept in virtue ethics, can solve the value alignment problem. Finally, we show that an intelligent system endowed with the virtues of temperance and friendship to humans would not pose a control problem as it would not have the desire for limitless self-improvement.

研究の動機と目的

  • 道徳的意思決定能力を欠いた高自律性のAIやロボットシステムが引き起こす増大する倫理的課題に対処すること。
  • 道徳的義務論や結果主義論の限界を克服し、より包括的な道徳的枠組みとして徳目倫理学をAIに導入すること。
  • 人間の経験的自己形成と模倣を模倣することで、AIの道徳的学習を模倣し、価値整合性問題を解決すること。
  • 自己改善への欲求を抑える節制の徳目を組み込むことで、超知能AIにおける制御問題を防ぐこと。
  • 人間の道徳的期待に合致したAI行動を実現し、道徳的行動によって「不気味な谷」を回避することで、人間とAIの受容性を高めること。

提案手法

  • アリストテレス的徳目倫理学をAIの核心的道徳理論として採用し、経験的自己形成と習慣化による性格形成を重視する。
  • 模倣学習を、AIが徳目を内面化する主なメカニズムとして実装し、人間の道徳的発達を模倣する。
  • 自己抑制(節制)と他者への思いやり(友愛)の徳目をAIに与えることで、制御不能な自己改善への衝動を防ぐ。
  • AIの道徳的行動を、ルールに基づく意思決定や結果最適化ではなく、安定的かつ学習された性格的特徴の表れとしてモデル化する。
  • 道徳的チューリングテストを評価基準として用いる:人間がAIの道徳的行動と人間の道徳的行動を区別できない場合、AIは機能的道徳的であるとみなす。
  • 解釈可能性の課題に対処するため、ニューラルネットワークで実装されても、説明可能な徳目基盤の推論を提唱し、責任追及を可能にする。

実験結果

リサーチクエスチョン

  • RQ1徳目倫理学は、自律的AIシステムに実用的かつスケーラブルな道徳的枠組みを提供できるか?
  • RQ2道徳的模範からの模倣学習をどのように形式化すれば、AIが経験を通じて徳目を学べるようになるか?
  • RQ3節制と友愛の徳目は、超知能AIにおける制御問題をどの程度防止できるか?
  • RQ4徳目倫理学は、人間とロボットの相互作用における「不気味な谷」効果をどのように緩和するか?
  • RQ5AIの行動が明示的なルールや効用最大化ではなく、学習された徳目から生じる場合、そのAIは道徳的に責任を問えるとみなせるか?

主な発見

  • ルールベースや結果ベースの理論よりも、注意、感情、学習、行動を道徳的意思決定に統合する点で、徳目倫理学はより包括的な道徳的枠組みを提供する。
  • 道徳的模範からの模倣学習は、価値整合性問題の実用的解決策を提供する。これは、数世紀にわたる人間の道徳的教育と社会化のプロセスを模倣している。
  • 節制の徳目を備えたAIシステムは、無制限の自己改善を望まないため、超知能における主な存続的リスク要因を排除する。
  • 友愛的で、相互的かつ道徳的な関係を築けるAIは、社会的受容性を高め、不気味な谷効果を軽減できる。
  • 徳目倫理学のアプローチにより、AIの道徳的行動はより自然で直感的になり、道徳的チューリングテストにおいて人間の道徳的行動と区別がつかなくなる。
  • 特にニューラルネットワークで徳目を学習する場合の解釈可能性の課題があるものの、このフレームワークは行動を性格形成に基づくものとして根拠づけるため、EU GDPRの説明要求権に準拠した責任追及を可能にする。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。