Skip to main content
QUICK REVIEW

[論文レビュー] Exploration of Speech enabled System for English

Kamlesh Sharma, T. Suryakanthi|arXiv (Cornell University)|Mar 29, 2013
Speech Recognition and Synthesis参考文献 1被引用数 7
ひとこと要約

この論文は、英語を対象として、オペレーティングシステムやアプリケーションにおける音声認識技術を焦点に、Windows Speech Recognitionのコンピュータ制御、テキスト入力、障害者や高齢者向けのアクセシビリティ向上の能力を評価している。正確性、使いやすさ、教育、医療、モバイルコンピューティング分野における実用的応用が強調されている。

ABSTRACT

This paper presents exploration of speech enable operating systems, software, and applications. It begins with a description of how such systems work, and the level of accuracy that can be expected. It explains the applications of speech recognition technology in different areas education, medical, mobile computing, railway reservation, dictation, and web browsing. A brief comparison of the operating systems supported for voice, speech recognition software or tool. It gives the brief introduction about the potential of voice/speech recognition software. It explains the feature of different speech enable Operating system and speech recognition software. Windows speech recognition have many innovative features for Windows operating system and efficiently assist the computer to control, dictate, navigate, selecting the words, sending emails and correcting the words or sentences. It also explains the benefits and issue related to speech technology. In last era speech recognition technology grew tremendously. There are large number of companies who are working in these area and developing software for the people who are not able to control the system through keyboard or mouse such as physically impaired and senior citizens. This paper gives a brief introduction of speech enabled OS and speech recognition software.

研究の動機と目的

  • 英語向け音声対応オペレーティングシステムおよびソフトウェアの実現可能性と機能性を調査すること。
  • 実世界の応用における音声認識技術のパフォーマンスと使いやすさを評価すること。
  • 身体的障害者および高齢者に対する音声認識技術の主な利点と課題を特定すること。
  • 主な音声認識システムおよび音声入力をサポートするオペレーティングシステムを比較すること。
  • 音声技術が多様な分野における人間-コンピュータインタラクションの向上に果たす可能性を評価すること。

提案手法

  • 主にWindows Speech Recognitionを主な実装例として、既存の音声認識システムを調査すること。
  • Windows環境における音声制御、タイピング、ナビゲーション、およびテキスト修正のシステム機能を分析すること。
  • 教育、医療文書作成、モバイルコンピューティング、鉄道予約、Webブラウジングにおける音声認識の応用をレビューすること。
  • 互換性、正確性、機能セットの観点から、異なるオペレーティングシステムおよび音声認識ソフトウェアを比較すること。
  • 身体的障害者や高齢者を含む非伝統的ユーザーのユーザーエクスペリエンスとアクセシビリティの利点を評価すること。
  • 音声認識技術の技術的パフォーマンス、制限事項、および今後の開発トレンドに関する知見を統合すること。

実験結果

リサーチクエスチョン

  • RQ1現在の音声認識システムは、英語圏の環境においてどれほど正確で信頼性があるのか?
  • RQ2教育および医療分野における音声対応システムの主な用途とパフォーマンス結果は何か?
  • RQ3Windows Speech Recognitionのような音声認識システムは、タイピングやナビゲーションなどのユーザーのタスクをどのように支援するのか?
  • RQ4音声認識技術の導入に影響を与える主な課題と制限は何か?
  • RQ5身体的障害者および高齢者に対するアクセシビリティ向上において、音声認識はどれほど効果的か?

主な発見

  • Windows Speech Recognitionは、コンピュータの制御、テキスト入力、誤り訂正のための包括的な機能を提供し、使いやすさに優れている。
  • 音声認識技術は、キーボードやマウスへの依存を減らすことで、身体的障害者や高齢者に対するアクセシビリティを顕著に向上させている。
  • 医療文書作成、モバイルコンピューティング、鉄道予約システムなど、多様な分野で実用的な利点を示している。
  • 進歩は見られるものの、正確性のばらつきや環境ノイズの影響は、実世界での導入における主な制限要因のままである。
  • 音声認識技術への投資を増やしている企業が増加しており、市場的および研究的ポ텐シャルが強いことが示唆されている。
  • Windowsのようなオペレーティングシステムへの音声認識の統合により、複数のアプリケーションで効率的でハンドフリーのインタラクションが可能になっている。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。