[論文レビュー] Artificial Intelligence in archival and historical scholarship workflow: HTS and ChatGPT
本論文は、アーカイブ研究および歴史的学術研究のワークフローへの人工知能(特にTranskribusとChatGPT)の統合を評価し、デジタル化された手紙の自動トランスクリプション、補正、正規化に焦点を当てている。バスクリア・アーカイブの366通の手紙を用いた研究では、ChatGPTが一部の誤りを生じるものの、AI補助正規化によって得られるテキストは学術的期待を満たしており、歴史的研究におけるデータ分析および計算言語学的応用を顕著に向上させることを示している。
This article examines the impact of Artificial Intelligence on the archival heritage digitization processes, specifically regarding the manuscripts' automatic transcription, their correction, and normalization. It highlights how digitality has compelled scholars to redefine Archive and History field and has facilitated the accessibility of analogue sources through digitization and integration into big data. The study focuses on two AI systems, namely Transkribus and ChatGPT, which enable efficient analysis and transcription of digitized sources. The article presents a test of ChatGPT, which was utilized to normalize the text of 366 letters stored in the Correspondence section of the Biscari Archive (Catania). Although the AI exhibited some limitations that resulted in inaccuracies, the corrected texts met expectations. Overall, the article concludes that digitization and AI can significantly enhance archival and historical research by allowing the analysis of vast amounts of data and the application of computational linguistic tools.
研究の動機と目的
- AIがアーカイブのデジタル化プロセス、特に歴史的手紙のトランスクリプション、補正、正規化に与える影響を評価すること。
- ChatGPTがバスクリア・アーカイブのルネサンス期イタリア語手紙の正規化にどの程度効果的であるかを評価すること。
- デジタル化とAIツールがアナログなアーカイブ資料のアクセシビリティおよび計算言語学的分析をどのように向上させるかを検討すること。
- デジタルトランスフォーメーションおよびビッグデータ統合の文脈において、アーカイブ研究および歴史的学術研究の再定義を検討すること。
- 大規模言語モデルを人文学研究のワークフローに適用する際の限界と実用的成果を特定すること。
提案手法
- 本研究では、バスクリア・アーカイブのデジタル化された手紙に対して、最初にTranskribusを用いて自動的トランスクリプションを実施する。
- ChatGPTを用いて、トランスクリプトのテキストを正規化し、綴り、文法、および言語的不整合性を是正する。
- バスクリア・アーカイブの「手紙」セクションに属する366通のルネサンス期イタリア語手紙からなるテストコーパスをChatGPTで処理する。
- 出力結果を熟練者による検証済みトランスクリプトと比較し、正確性と信頼性を評価する。
- AIツールを計算パイプラインに統合し、歴史的テキスト分析のためのスケーラブルなデータ処理を可能にする。
- デジタル図書館およびビッグデータフレームワークを活用し、デジタル化されたアーカイブコンテンツの保存、検索、分析を支援する。
実験結果
リサーチクエスチョン
- RQ1ChatGPTは、バスクリア・アーカイブのルネサンス期イタリア語手紙のテキストをどの程度正確に正規化できるか。
- RQ2AI補助トランスクリプションおよび正規化プロセスは、従来の手作業手法と比較して、どの程度効率的で正確であるか。
- RQ3大規模言語モデル(例:ChatGPT)を歴史的手紙処理に適用する際の主な限界は何か。
- RQ4TranskribusやChatGPTといったAIツールの統合は、アーカイブ研究および歴史的学術研究のワークフローをどのように変容させるか。
- RQ5AI強化型のデジタル化ワークフローは、歴史的アーカイブのスケーラブルな計算言語学的分析を可能にするか。
主な発見
- ChatGPTはバスクリア・アーカイブの366通のルネサンス期イタリア語手紙の正規化において、いくつかの誤りを生じさせた。これは、歴史的言語的ニュアンスを処理する際の限界を示している。
- 誤りが存在するものの、ChatGPTが生成した修正済みテキストは学術的期待を満たしており、実際のアーカイブ応用における実用的価値を示している。
- AIツールの統合により、大規模な歴史的手紙の処理効率が顕著に向上した。
- デジタル化とAIにより、アーカイブ資料への計算言語学的ツールの適用が可能になり、分析の可能性が拡張された。
- 本研究は、AI補助ワークフローがスケーラブルでデータ駆動型の歴史的研究を支援できることを確認したが、品質保証のための人的監視が不可欠であることを示している。
- TranskribusとChatGPTは、アーカイブ研究における自動トランスクリプションおよび正規化の実用的パイプラインを形成している。
より良い研究を、今すぐ始めましょう
論文の読解から最終レビューまで、研究時間を劇的に削減しましょう。
クレジットカード登録不要
このレビューはAIが作成し、人間の編集者が確認しました。