日本文書のためのAI研究基盤の構築――機械翻訳・手書き文字認識・意味検索による統合日本学の国際展開

進行中

日本文書のためのAI研究基盤の構築――機械翻訳・手書き文字認識・意味検索による統合日本学の国際展開

研究期間 2026年8月 - 2030年3月
研究代表者 ニアディッヒ・セバスチャン(東北大学 統合日本学センター 助教)

研究概要

本プロジェクトは、AI(人工知能)を日本の文書資料に本格的に応用するためのデジタル研究基盤を構築する国際共同研究である。機械翻訳・検索プラットフォーム「Dharmamitra」への日本語訳・研究文献の統合(2026~27年度)、くずし字を含む手書き文書のAI文字認識(OCR・HTR)モデルの開発(2027~29年度)、日本語文書の意味検索・RAG基盤の構築(2027~30年度)を段階的に進め、最終的に誰もが利用できるデータベース・アプリケーションとして公開する。

長期的には、二次文献のスマート検索システムの開発と、仏教文献日本語訳の自動分かち書き・固有表現タグ付け等の言語資源化を、国内外の研究協力者との共同研究の軸とする。研究期間を通じて、国内外の研究者や全国から公募した学生・若手研究者が参加する公開ワークショップ・シンポジウム等を度開催し、AIによる古典テキスト分析を担う次世代人材を育成する。研究成果は国際会議で毎年度発表し、継続的に世界へ発信する。

研究メンバー

ニアディッヒ・セバスチャン

研究代表者
東北大学 統合日本学センター 助教

専門分野:計算文献学・自然言語処理

加藤 諭

研究分担者
東北大学 統合日本学センター 副センター長
学術資源研究公開センター史料館 教授

専門分野:日本近現代史・アーカイブズ学

その他参画者

菊谷 竜太
(高野山大学 文学部密教学科 准教授/東北大学 統合日本学センター)

Oliver HELLWIG
(University of Zurich, Center for the Interdisciplinary Study of Language Evolution, Researcher)

Sven SELLMER
(Adam Mickiewicz University, Institute of Oriental Studies, Professor)

Jonathan SILK
(Leiden University, Leiden University Institute for Area Studies, Professor)

研究概要(スライド)

本プロジェクトの研究概要スライドです。(クリックすると大きく表示されます)