Skip to main content
QUICK REVIEW

[論文レビュー] Visual Passwords Using Automatic Lip Reading

Ahmad B. Hassanat|arXiv (Cornell University)|Sep 2, 2014
Biometric Identification and Security参考文献 7被引用数 14
ひとこと要約

本論文では、セットアップ段階と検証段階で特徴ベクトルの抽出と比較を行うことで、ビデオからの自動的で唇の動きを読み取る技術を活用してユーザーを認証する視覚的パスワードシステムを提案する。30人の被験者を対象に2つのデータベースで評価した結果、平均誤り率は7.63%から20.51%の間で推移し、従来の資格情報と組み合わせることで実用的なバイオメトリクス認証手法としての可能性を示している。

ABSTRACT

This paper presents a visual passwords system to increase security. The system depends mainly on recognizing the speaker using the visual speech signal alone. The proposed scheme works in two stages: setting the visual password stage and the verification stage. At the setting stage the visual passwords system request the user to utter a selected password, a video recording of the user face is captured, and processed by a special words-based VSR system which extracts a sequence of feature vectors. In the verification stage, the same procedure is executed, the features will be sent to be compared with the stored visual password. The proposed scheme has been evaluated using a video database of 20 different speakers (10 females and 10 males), and 15 more males in another video database with different experiment sets. The evaluation has proved the system feasibility, with average error rate in the range of 7.63% to 20.51% at the worst tested scenario, and therefore, has potential to be a practical approach with the support of other conventional authentication methods such as the use of usernames and passwords.

研究の動機と目的

  • 視覚的スピーチ認識に基づく視覚的パスワードメカニズムを導入することで、システムのセキュリティを向上させること。
  • 音声に依存せずに、発話中の顔の動きという視覚的情報のみを用いてユーザー認証を可能にすること。
  • 多様な被験者を対象とした現実世界のシナリオにおいて、視覚的パスワードの実用可能性を評価すること。
  • 従来の認証方法と視覚的パスワードシステムを統合することで、セキュリティを強化すること。

提案手法

  • システムは、セットアップ段階でユーザーが選択したパスワードを発話する様子の動画をキャプチャする。
  • 単語ベースの動画スピーチ認識(VSR)システムが、顔の動画から特徴ベクトルの系列を抽出する。
  • 検証段階では、同じプロセスを繰り返し、抽出された特徴を保存された視覚的パスワードテンプレートと比較する。
  • 特徴の比較は類似度メトリクスを用いて実施され、認証の成功または失敗が決定される。
  • システムは二段階のアーキテクチャを採用している:パスワード登録段階とリアルタイム検証段階。
  • VSRシステムは音声とは独立して、唇および顔の動きのパターンに焦点を当てて視覚的スピーチ信号を処理する。

実験結果

リサーチクエスチョン

  • RQ1視覚的スピーチ認識を効果的に活用して、安全かつ信頼性の高い視覚的パスワードシステムを構築できるか?
  • RQ2性別や発話スタイルの違いを含む多様な被験者に対して、このシステムはどの程度の性能を示すか?
  • RQ3現実的な条件下で、視覚的パスワードシステムの達成可能な誤り率はどの程度か?
  • RQ4このシステムは、従来のユーザーネームとパスワード認証の有効な補完として機能できるか?

主な発見

  • 異なるテスト環境において、平均誤り率が7.63%から20.51%の範囲に収まり、高い実用可能性が示された。
  • 20名の被験者(男性10名、女性10名)からなるデータベース上で、システムは顔の性別を越えた認識能力を検証した。
  • 追加の15名の男性被験者を含むテストセットにより、多様な男性被験者においても一貫した性能が確認された。
  • これらの結果は、視覚的パスワードを多要素認証システムにおける実用的なバイオメトリクス要因として統合可能であることを支持する。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。