古代ギリシャ語専用LLM「Apollo」公開

原題: A New Chatbot Wants to Unlock the Secrets in Tattered Ancient Greek Records

なぜ重要か

人文学領域へのLLM応用が本格化しており、デジタル人文学における古典語処理の標準ツールになり得る先例として注目される。

オーストリア科学アカデミーは2026年9月24日、フランスのAIラボMistralおよびSail Replyと共同開発した古代ギリシャ語専用の大規模言語モデル「Apollo」を公開する。約6億語の歴史的ギリシャ語データで学習し、損傷したパピルスの欠損部分を統計的に補完する機能を持つ。研究者向けに無償のチャットボット形式で提供される。

世界各地の学術図書館には数十万点もの古代ギリシャ語パピルス断片が保管されているが、破損が激しく判読困難なものも多い。従来の解読・復元作業は、古代ギリシャ文字に単語間の空白がないため、まず語の区切りを特定し、文書の年代を推定し、社会・政治的背景を踏まえながら欠損語を選定するという、高度な専門知識を要する工程が必要だった。UCLの古典・歴史言語学教授Stephen Colvinは「世界でもそのレベルのギリシャ史の専門家は極めて少ない」と述べる。

Apolloはこうした専門知識をモデルに組み込む形で開発された。写本・パピルス・碑文から収集した約6億語の古代ギリシャ語で学習しており、ホメロスのテキストにはホメロス的ギリシャ語を、ドーリア方言の碑文にはドーリア方言を用いて補完するという。オーストリア科学アカデミーの歴史家・パピルス学者Anna Dolganovはこの機能を端的にそう説明する。

Sail ReplyのパートナーDimitris Vlitasは、このようなかたちで知識を解放できることは「1年前には考えられなかった」とWIREDに語った。オックスフォード大学の古典文学教授Armand D'Angourも「空白に入りうる3つの候補語を機械が示してくれれば、作業は大幅に速くなる」と歓迎する。同大学は世界最大の古代パピルスコレクションを擁する。

ただし、Apolloが古代史の大局を塗り替えるような発見をもたらす可能性は低い。未復元のパピルスの多くは個人的な手紙や婚姻契約書、行政文書といった日常的な内容だ。Colvinは「突然ソポクレスの新作が出てくるとは思わないでほしい」と釘を刺しつつ、古代生活の細部の解明や既存の学術的仮説の補強には貢献し得ると指摘する。

出典

wired.com — 元記事を読む →