このサイトは現在開発中です

JapanTracker 国立国会図書館のデジタル化資料・書誌データとAI学習データ利用をめぐる政策

国立国会図書館のデジタル化資料・書誌データとAI学習データ利用をめぐる政策

期間
2019年3月29日〜2025年12月2日
記録
6件
報道
4件

概要

国立国会図書館(NDL)のデジタル化資料・書誌データと、AI学習データとしての利用をめぐる記録。次世代デジタルライブラリーの公開と政府のAI学習データ提供方針から、AI開発企業からの要請への対応、研究機関への全文テキストデータ提供までを扱う。

記録 記録はすべてAIが集めています。出典は例外なく付けていますが、その多くは出典を示しただけで、本文まで読んで確かめたものではありません。内容の正確さは保証できないので、必ず出典に当たって確認してください。事実関係に争いのあるものは、記録の本文と注記に書いています。各記録の「出典・関連する人物や組織」を開くと、出典の一覧と、関わった人物・組織のページへのリンクが出ます。

  1. 次世代デジタルライブラリーを公開

    国立国会図書館がNDLラボで、全文テキスト検索機能や機械学習(AI技術)を応用した自動画像処理機能など、次世代図書館システムへの実装が期待される新技術の技術的有効性を検証する実験的サービス「次世代デジタルライブラリー」を公開した。当初の対象は、国立国会図書館デジタルコレクションのうち著作権保護期間が満了し、日本十進分類(NDC)6類(産業)に分類される資料の一部(10,550点)だった。

    出典 3件・関連する人物や組織 1件

    出典

    関連する人物や組織

    国立国会図書館次世代システム開発研究室(NDLラボ)

  2. AI学習データ提供のアクションプラン

    内閣府のAI戦略会議(第6回)が、政府等が保有するデータをAI開発企業のニーズに応じて学習データとして提供する枠組みを定めた「AI学習データの提供促進に向けたアクションプランver1.0」を示した。行政文書・法令・地図データ・特許情報などをまず提供可能なデータとしつつ、国立国会図書館がデジタル化した蔵書データや国立研究所の研究データも、権利上の問題がないものについて開発企業の要望に応じて提供する方針が盛り込まれた。2023年内に開発企業からの提供希望を受け付ける窓口を設け、2024年に提供を始める想定とされた。

    注記: アクションプランの内容は複数の報道の要約に基づく。原資料(内閣府AI戦略会議の配布資料)本文は未確認。

    出典 3件・関連する人物や組織 3件

    出典

    関連する人物や組織

    国立国会図書館は保有データの提供候補として名指しされた側で、アクションプラン自体の策定主体はAI戦略会議・内閣府

  3. 国会図書館がOpenAIの要請を拒否

    OpenAIが国立国会図書館に対し、デジタル化資料のデータを日本語の学習データとして提供するよう要請したが、国立国会図書館はこれを断ったと日本経済新聞が報じた。同紙の報道によれば、NDL側は要請を断る一方、著作権保護期間が満了した資料の提供(次世代デジタルライブラリー等での公開)を案内したという。

    注記: 要請・拒否の正確な日付、やり取りの具体的内容、NDLの公式見解は本文未確認。検索結果に表示された記事タイトル・要約のみに基づく記録であり、日付は「2024年2月ごろ」という要約表現から月単位の精度とした。一次資料(NDLの公式発表)は確認できていない。

    出典 2件・関連する人物や組織 2件

    出典

    関連する人物や組織

  4. NDLラボが構造化テキストを試行提供

    NDLラボが、次世代デジタルライブラリーのBook API・Page APIから、著作権保護期間が満了した図書資料約28万点分のOCR全文テキストデータについて、段落・キャプション・タイトルなどのレイアウト要素を備えた構造化テキストデータを試行的に提供開始したと発表した。構造化テキストデータは、国立国会図書館が開発したOCR処理プログラムによって自動付与されたレイアウト情報・読み順推定に基づくもので、誤りを含みうるとされる。あわせて多段組や複雑なレイアウトのテキストの読み順の改善も行われた。

    出典 2件・関連する人物や組織 1件

    出典

    関連する人物や組織

    国立国会図書館次世代システム開発研究室(NDLラボ)

  5. 国会図書館がNIIに全文テキスト提供

    国立国会図書館は、国立情報学研究所(NII)における大規模言語モデル(LLM)構築を目的として、官庁出版物(主に1995年までに刊行された図書のほか雑誌・官報を含む)約30万点分の、デジタル化画像からOCR技術により作成した全文テキストデータを提供することについて、NIIと合意したと公表した。合意は2025年9月5日付とされ、1995年にNDLとNII(当時の学術情報センター)の間で締結された相互協力協定に基づく取組と位置づけられている。

    注記: 合意日(9月5日)と公表日(10月1日)の関係、提供データの具体的な範囲・利用条件の詳細は本文未確認。

    出典 3件・関連する人物や組織 2件

    出典

    関連する人物や組織

  6. 次世代デジタルライブラリーにテキスト表示

    国立国会図書館が次世代デジタルライブラリーに「テキストモード」を追加したと発表した。テキストモードは、デジタル化画像の代わりに読み順を整序した全文テキストデータを横書きで表示する機能で、通常のウェブサイトと同様の感覚で資料を閲覧できるようにすることを目的とする。対象は、国立国会図書館デジタルコレクションでインターネット公開されている著作権保護期間満了の図書・古典籍のデジタル化資料(約35万点)。

    出典 2件・関連する人物や組織 1件

    出典

    関連する人物や組織

    国立国会図書館次世代システム開発研究室(NDLラボ)

今後わかること このページは、現時点で出典を確認できた事実を集めたものです。これで全容が分かるわけではありません。調査は継続中で、以下の資料や判断はまだ出ていません。これらによって、原因の評価も責任の所在も変わりえます。このページの記述だけで結論を出さないでください。

  1. NDL提供の官庁出版物約30万点分のテキストデータが実際にどのような大規模言語モデルの学習に使われ、いつ公開・提供されるか

    国立情報学研究所によるLLM構築の進捗・成果の公表 /国立情報学研究所(NII)

  2. 提供データがどこまで利用されるか(研究目的限定か、商用モデルへの組み込みも想定するか)

    国立情報学研究所によるLLM構築の進捗・成果の公表 /国立情報学研究所(NII)

  3. 現在提供対象となっている著作権保護期間満了資料(約28万〜35万点)を超えて、保護期間内の蔵書データがAI学習データとして提供される範囲が広がるか

    著作権保護期間内資料のAI学習データとしての扱いの方針確定 /国立国会図書館・資料デジタル化及び利用に係る関係者協議会

    国立国会図書館は出版社等の関係者を交えた「資料デジタル化及び利用に係る関係者協議会」を継続的に開催しており(令和7年度第2回は2026年2月5日開催予定と検索結果に表示された)、この場での議論の帰趨が今後の提供範囲に影響するとみられる。

  4. 出版業界(出版社・著作者団体等)との協議を経て、権利者の懸念にどう応えるかの具体的な条件・除外手続が定まるか

    著作権保護期間内資料のAI学習データとしての扱いの方針確定 /国立国会図書館・資料デジタル化及び利用に係る関係者協議会

  5. 実験的サービスとして続く次世代デジタルライブラリー(全文検索・テキストモード・構造化テキストデータ提供等)が、正式サービスへ格上げされるか、あるいは実験的機能が国立国会図書館デジタルコレクション本体に統合されるか

    次世代デジタルライブラリーの実験的サービスからの位置づけ変更 /国立国会図書館

報道 このケースについて観測できた報道の一覧です。網羅ではなく、「どうやって集めたか」に書いた範囲で見つかったものだけを載せています。探していない媒体・期間・経路があるので、件数を媒体どうしで比べることはできません。ある媒体の記事がここに無いことは、その媒体が報じなかったことを意味しません。

どうやって集めたか・観測結果(0件)

どうやって集めたか

  1. 手作業での収集

    注記: このケースの records[] の出典として集めてあった報道記事を、そのまま報道一覧に転記したもの。個々の記事をどの検索でいつ見つけたかは記録が残っていない。この分については収集経路をたどれない。報道機関以外(官公庁・企業・団体の公表資料、法律事務所やコンサルの解説、個人の発信)は報道ではないので含めていない。

  1. 日経クロステック 生成AIの学習に政府保有データを提供へ、国会図書館の蔵書や国の研究データも対象

    関連する記録 1件・収集経路

    関連する記録

    アーカイブ

    https://web.archive.org/web/20260216020504/https://xtech.nikkei.com/atcl/nxt/news/18/16244/

    収集経路

    2026年8月14日の手作業での収集

  2. HON.jp News Blog 国立国会図書館はOpenAIからのデータ提供要請を断っていたなど 日刊出版ニュースまとめ 2025.12.30

    関連する記録 1件・収集経路

    関連する記録

    収集経路

    2026年8月14日の手作業での収集

  3. 日本経済新聞 ChatGPT、日本攻略で誤算 扉を閉じた「国会図書館」

    関連する記録 1件・収集経路

    関連する記録

    アーカイブ

    https://web.archive.org/web/20250630005354/https://www.nikkei.com/prime/digital-governance/article/DGXZQOGN270PK0X20C24A2000000

    収集経路

    2026年8月14日の手作業での収集

  4. ITmedia 官庁出版物30万点、AIモデルに活用へ 国会図書館がNIIに提供

    関連する記録 1件・収集経路

    関連する記録

    アーカイブ

    https://web.archive.org/web/20251020224403/https://www.itmedia.co.jp/news/articles/2510/02/news102.html

    収集経路

    2026年8月14日の手作業での収集

このページの作り方と限界

  • OpenAIによるNDLへのデータ提供要請とNDLの拒否(r-2024-02-01-openai-request-declined)は、日本経済新聞「ChatGPT、日本攻略で誤算 扉を閉じた『国会図書館』」(2024年3月12日付とみられる)と、これを引用したHON.jp News Blogの記事見出し・要約のみに基づく。要請・拒否の正確な日付、要請の具体的な内容、NDL側の公式コメントの有無は本文未確認。一次資料(NDLの公式発表等)による裏付けが取れていない点に注意。
  • 実名は法人・組織名(国立国会図書館、国立情報学研究所、OpenAI、内閣府、AI戦略会議)のみを記載した。私人の実名は含まれない。
  • 官庁出版物の全文テキストデータ提供に関する合意日(2025年9月5日)と公表日(2025年10月1日)は検索結果の要約に基づく。両者の関係(合意後に約1か月を経て公表された経緯)の詳細は本文未確認。

このページを読んで…