Skip to main content
QUICK REVIEW

[論文レビュー] Design of English-Hindi Translation Memory for Efficient Translation

Nisheeth Joshi, Iti Mathur|arXiv (Cornell University)|Oct 19, 2012
Natural Language Processing Techniques参考文献 4被引用数 7
ひとこと要約

本論文は、以前に翻訳されたセグメントを保存し、曖昧な文のための順位付けられた複数の提案を提供することで、効率的で再利用可能な翻訳を可能にする、カスタム設計された英語・ヒンディー語翻訳メモリシステムを提示する。このツールはグローバル保存およびローカル保存をサポートし、共同作業を促進し、重複する翻訳作業を削減する—インドの言語においてこのようなツールが少ない中で特に価値がある。

ABSTRACT

Developing parallel corpora is an important and a difficult activity for Machine Translation. This requires manual annotation by Human Translators. Translating same text again is a useless activity. There are tools available to implement this for European Languages, but no such tool is available for Indian Languages. In this paper we present a tool for Indian Languages which not only provides automatic translations of the previously available translation but also provides multiple translations, in cases where a sentence has multiple translations, in ranked list of suggestive translations for a sentence. Moreover this tool also lets translators have global and local saving options of their work, so that they may share it with others, which further lightens the task.

研究の動機と目的

  • インドの言語、特に機械翻訳および並列コーパス開発の文脈において、翻訳メモリツールの不足に対処すること。
  • 以前に翻訳されたセグメントを再利用することで、重複する翻訳作業を削減すること。
  • 意味が曖昧または文脈依存的な文の複数の妥当な翻訳を、順位付けして提示することで、翻訳者の作業効率を向上させること。
  • 翻訳作業をグローバルまたはローカルに保存・共有できる仕組みを提供し、共同翻訳ワークフローを支援すること。
  • 英語・ヒンディー語ペアの高品質で再利用可能な並列コーパスの作成および維持を支援すること。

提案手法

  • インドの言語、特に英語・ヒンディー語向けに最適化された翻訳メモリアーキテクチャの設計。
  • 検索可能なメタデータを含む、ソース文とターゲット文のペアを格納するためのデータベーススキーマの実装。
  • ファジィマッチングと類似度スコアリングを用いて、新しい入力に対する以前に翻訳されたセグメントを検索する。
  • 関連性と使用頻度に基づいて、文の複数の可能な翻訳を順位付けする。
  • 永続的保存と翻訳作業の共有を可能にする、グローバルおよびローカル保存メカニズムの統合。
  • 順位付けされた提案を表示し、手動での選択や編集を可能にするGUIを通じたユーザーインタラクションの支援。

実験結果

リサーチクエスチョン

  • RQ1インドの言語、たとえばヒンディー語のような言語において、このようなツールが現在利用可能でない中で、翻訳メモリシステムを効果的に設計するにはどうすればよいか?
  • RQ2翻訳メモリは、英語・ヒンディー語翻訳タスクにおいて、どの程度重複する翻訳作業を削減できるか?
  • RQ3一文に対して複数の妥当な翻訳を、どのように順位付けして提示すれば、翻訳者の作業効率を向上させられるか?
  • RQ4翻訳作業のグローバルおよびローカル保存を通じて、共同翻訳を支援するにはどのようなメカニズムが必要か?
  • RQ5翻訳メモリの統合は、低リソース言語ペアにおける並列コーパスの品質と再利用可能性にどのように影響するか?

主な発見

  • 提案されたシステムは、英語・ヒンディー語翻訳タスクにおいて、以前に翻訳されたセグメントの効率的再利用を成功裏に実現した。
  • 曖昧な文に対して関連性に基づいて順位付けされた複数の翻訳提案が提供され、翻訳者の意思決定を改善した。
  • グローバルおよびローカル保存オプションにより、翻訳作業の永続的保存と共有が可能になり、共同作業が促進された。
  • 特に低リソース言語ペアの文脈において、保存された翻訳を活用することで、手作業での再作業が削減された。
  • インド語NLP分野における重要な空白を埋める形で、英語・ヒンディー語ペアに特化した機能的な翻訳メモリを提供した。
  • 特に学術的および機関的文脈において、実際の翻訳ワークフローへの実用的妥当性が示された。

より良い研究を、今すぐ始めましょう

論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。

クレジットカード登録不要

このレビューはAIが作成し、人間の編集者が確認しました。