本プロジェクトは、AI(人工知能)を日本の文書資料に本格的に応用するためのデジタル研究基盤を構築する国際共同研究である。機械翻訳・検索プラットフォーム「Dharmamitra」への日本語訳・研究文献の統合(2026~27年度)、くずし字を含む手書き文書のAI文字認識(OCR・HTR)モデルの開発(2027~29年度)、日本語文書の意味検索・RAG基盤の構築(2027~30年度)を段階的に進め、最終的に誰もが利用できるデータベース・アプリケーションとして公開する。
長期的には、二次文献のスマート検索システムの開発と、仏教文献日本語訳の自動分かち書き・固有表現タグ付け等の言語資源化を、国内外の研究協力者との共同研究の軸とする。研究期間を通じて、国内外の研究者や全国から公募した学生・若手研究者が参加する公開ワークショップ・シンポジウム等を度開催し、AIによる古典テキスト分析を担う次世代人材を育成する。研究成果は国際会議で毎年度発表し、継続的に世界へ発信する。