# 国立国会図書館のデジタル化資料・書誌データとAI学習データ利用をめぐる政策

> JapanTracker（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/）の機械可読版です。
> 日本の政治と社会について「誰が・いつ・何をしたか」を出典と日付を添えて記録しています。評価や結論は書きません。
> 記録の収集・執筆・検証はすべてAIが行っており、人手による確認の工程を置いていません。すべてに出典を付けていますが、出典を示しただけで本文まで読んで裏を取っていない記録が含まれます。
> 記録は網羅ではありません。ここに無いことは「起きなかった」ことでも「報じられなかった」ことでもありません。
> 引用する場合は、各記録に付けた出典に当たって確認してください。

- ページ: https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/
- 記録の期間: 2019年3月29日〜2025年12月2日
- 記録: 6件
- 最終確認: 2026年8月13日

## 概要

国立国会図書館（NDL）のデジタル化資料・書誌データと、AI学習データとしての利用をめぐる記録。次世代デジタルライブラリーの公開と政府のAI学習データ提供方針から、AI開発企業からの要請への対応、研究機関への全文テキストデータ提供までを扱う。

## 記録

### 2019年3月29日 次世代デジタルライブラリーを公開

- 記録ID: baa9725d-493c-47e2-aaa2-89dc06e66a2e（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#baa9725d-493c-47e2-aaa2-89dc06e66a2e）
- 人物・組織: 国立国会図書館
- 人物・組織の補足: 国立国会図書館次世代システム開発研究室（NDLラボ）

国立国会図書館がNDLラボで、全文テキスト検索機能や機械学習（AI技術）を応用した自動画像処理機能など、次世代図書館システムへの実装が期待される新技術の技術的有効性を検証する実験的サービス「次世代デジタルライブラリー」を公開した。当初の対象は、国立国会図書館デジタルコレクションのうち著作権保護期間が満了し、日本十進分類（NDC）6類（産業）に分類される資料の一部（10,550点）だった。

出典:
- 国立国会図書館カレントアウェアネス・ポータル「国立国会図書館、NDLラボで「次世代デジタルライブラリー」を公開」 https://current.ndl.go.jp/car/37908 ／ アーカイブ: https://web.archive.org/web/20260521024348/https://current.ndl.go.jp/car/37908
- 国立国会図書館カレントアウェアネス・ポータル「E2154 – 国立国会図書館，次世代デジタルライブラリーを公開」 https://current.ndl.go.jp/e2154 ／ アーカイブ: https://web.archive.org/web/20260520040454/https://current.ndl.go.jp/e2154
- 国立国会図書館「次世代デジタルライブラリー | NDLラボ」 https://lab.ndl.go.jp/service/tsugidigi/ ／ アーカイブ: https://web.archive.org/web/20260325010651/https://lab.ndl.go.jp/service/tsugidigi/

### 2023年11月7日 AI学習データ提供のアクションプラン

- 記録ID: b720d74d-9e90-4fc8-bbe6-092ac4a58a9e（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#b720d74d-9e90-4fc8-bbe6-092ac4a58a9e）
- 人物・組織: AI戦略会議、内閣府、国立国会図書館
- 人物・組織の補足: 国立国会図書館は保有データの提供候補として名指しされた側で、アクションプラン自体の策定主体はAI戦略会議・内閣府

内閣府のAI戦略会議（第6回）が、政府等が保有するデータをAI開発企業のニーズに応じて学習データとして提供する枠組みを定めた「AI学習データの提供促進に向けたアクションプランver1.0」を示した。行政文書・法令・地図データ・特許情報などをまず提供可能なデータとしつつ、国立国会図書館がデジタル化した蔵書データや国立研究所の研究データも、権利上の問題がないものについて開発企業の要望に応じて提供する方針が盛り込まれた。2023年内に開発企業からの提供希望を受け付ける窓口を設け、2024年に提供を始める想定とされた。

注記: アクションプランの内容は複数の報道の要約に基づく。原資料（内閣府AI戦略会議の配布資料）本文は未確認。

出典:
- 日経クロステック「生成AIの学習に政府保有データを提供へ、国会図書館の蔵書や国の研究データも対象」 https://xtech.nikkei.com/atcl/nxt/news/18/16244/ ／ アーカイブ: https://web.archive.org/web/20260216020504/https://xtech.nikkei.com/atcl/nxt/news/18/16244/
- 国立国会図書館カレントアウェアネス・ポータル「内閣府、AI戦略会議（第6回）の配布資料と議事要旨を公開」 https://current.ndl.go.jp/car/197372 ／ アーカイブ: https://web.archive.org/web/20260607105153/https://current.ndl.go.jp/car/197372
- 内閣府「AI戦略 - 科学技術・イノベーション」 https://www8.cao.go.jp/cstp/ai/index.html ／ アーカイブ: https://web.archive.org/web/20260801122742/https://www8.cao.go.jp/cstp/ai/index.html

### 2024年2月 国会図書館がOpenAIの要請を拒否

- 記録ID: 304ecdd3-a414-4279-8405-30ccea057816（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#304ecdd3-a414-4279-8405-30ccea057816）
- 人物・組織: OpenAI、国立国会図書館

OpenAIが国立国会図書館に対し、デジタル化資料のデータを日本語の学習データとして提供するよう要請したが、国立国会図書館はこれを断ったと日本経済新聞が報じた。同紙の報道によれば、NDL側は要請を断る一方、著作権保護期間が満了した資料の提供（次世代デジタルライブラリー等での公開）を案内したという。

注記: 要請・拒否の正確な日付、やり取りの具体的内容、NDLの公式見解は本文未確認。検索結果に表示された記事タイトル・要約のみに基づく記録であり、日付は「2024年2月ごろ」という要約表現から月単位の精度とした。一次資料（NDLの公式発表）は確認できていない。

出典:
- 日本経済新聞「ChatGPT、日本攻略で誤算 扉を閉じた「国会図書館」」 https://www.nikkei.com/prime/digital-governance/article/DGXZQOGN270PK0X20C24A2000000 ／ アーカイブ: https://web.archive.org/web/20250630005354/https://www.nikkei.com/prime/digital-governance/article/DGXZQOGN270PK0X20C24A2000000
- HON.jp News Blog「国立国会図書館はOpenAIからのデータ提供要請を断っていたなど 日刊出版ニュースまとめ 2025.12.30」 https://hon.jp/news/1.0/0/58004

### 2025年8月26日 NDLラボが構造化テキストを試行提供

- 記録ID: df70956a-f09d-4c59-81a9-677093960cb2（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#df70956a-f09d-4c59-81a9-677093960cb2）
- 人物・組織: 国立国会図書館
- 人物・組織の補足: 国立国会図書館次世代システム開発研究室（NDLラボ）

NDLラボが、次世代デジタルライブラリーのBook API・Page APIから、著作権保護期間が満了した図書資料約28万点分のOCR全文テキストデータについて、段落・キャプション・タイトルなどのレイアウト要素を備えた構造化テキストデータを試行的に提供開始したと発表した。構造化テキストデータは、国立国会図書館が開発したOCR処理プログラムによって自動付与されたレイアウト情報・読み順推定に基づくもので、誤りを含みうるとされる。あわせて多段組や複雑なレイアウトのテキストの読み順の改善も行われた。

出典:
- 国立国会図書館「次世代デジタルライブラリーAPIからの構造化テキストデータの提供について | NDLラボ」 https://lab.ndl.go.jp/news/2025/2025-08-26/ ／ アーカイブ: https://web.archive.org/web/20260518153651/https://lab.ndl.go.jp/news/2025/2025-08-26/
- 文学サイト（BUNGAKU REPORT）「次世代デジタルライブラリーAPIからの構造化テキストデータの提供について（国立国会図書館・NDLラボ）」 https://bungaku-report.com/blog/2025/08/apindl.html ／ アーカイブ: https://web.archive.org/web/20250828110857/https://bungaku-report.com/blog/2025/08/apindl.html

### 2025年10月1日 国会図書館がNIIに全文テキスト提供

- 記録ID: 9df8e2ca-385c-4601-b299-7e7ee50ab152（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#9df8e2ca-385c-4601-b299-7e7ee50ab152）
- 人物・組織: 国立国会図書館、国立情報学研究所

国立国会図書館は、国立情報学研究所（NII）における大規模言語モデル（LLM）構築を目的として、官庁出版物（主に1995年までに刊行された図書のほか雑誌・官報を含む）約30万点分の、デジタル化画像からOCR技術により作成した全文テキストデータを提供することについて、NIIと合意したと公表した。合意は2025年9月5日付とされ、1995年にNDLとNII（当時の学術情報センター）の間で締結された相互協力協定に基づく取組と位置づけられている。

注記: 合意日（9月5日）と公表日（10月1日）の関係、提供データの具体的な範囲・利用条件の詳細は本文未確認。

出典:
- 国立国会図書館「国立情報学研究所における大規模言語モデル構築への協力について」 https://www.ndl.go.jp/jp/news/fy2025/251001_01.html ／ アーカイブ: https://web.archive.org/web/20251115155719/https://www.ndl.go.jp/jp/news/fy2025/251001_01.html
- 国立国会図書館カレントアウェアネス・ポータル「国立国会図書館（NDL）、国立情報学研究所（NII）における大規模言語モデル構築を目的とした、官庁出版物の全文テキストデータ提供について合意」 https://current.ndl.go.jp/car/259126 ／ アーカイブ: https://web.archive.org/web/20260611005927/https://current.ndl.go.jp/car/259126
- ITmedia NEWS「官庁出版物30万点、AIモデルに活用へ 国会図書館がNIIに提供」 https://www.itmedia.co.jp/news/articles/2510/02/news102.html ／ アーカイブ: https://web.archive.org/web/20251020224403/https://www.itmedia.co.jp/news/articles/2510/02/news102.html

### 2025年12月2日 次世代デジタルライブラリーにテキスト表示

- 記録ID: dbc5a54c-a7bc-4dbf-9f2b-9ea715cb4dee（https://japantracker.net/cases/7f9a4791-13b5-48e1-b48c-7c7918915c9b/#dbc5a54c-a7bc-4dbf-9f2b-9ea715cb4dee）
- 人物・組織: 国立国会図書館
- 人物・組織の補足: 国立国会図書館次世代システム開発研究室（NDLラボ）

国立国会図書館が次世代デジタルライブラリーに「テキストモード」を追加したと発表した。テキストモードは、デジタル化画像の代わりに読み順を整序した全文テキストデータを横書きで表示する機能で、通常のウェブサイトと同様の感覚で資料を閲覧できるようにすることを目的とする。対象は、国立国会図書館デジタルコレクションでインターネット公開されている著作権保護期間満了の図書・古典籍のデジタル化資料（約35万点）。

出典:
- 国立国会図書館「次世代デジタルライブラリーへの「テキストモード」の追加について | NDLラボ」 https://lab.ndl.go.jp/news/2025/2025-12-02/ ／ アーカイブ: https://web.archive.org/web/20260518161940/https://lab.ndl.go.jp/news/2025/2025-12-02/
- 国立国会図書館カレントアウェアネス・ポータル「国立国会図書館（NDL）、「次世代デジタルライブラリー」に「テキストモード」を追加：デジタル化画像の代わりに、読み順を整序した全文テキストデータを表示」 https://current.ndl.go.jp/car/262886 ／ アーカイブ: https://web.archive.org/web/20260415133722/https://current.ndl.go.jp/car/262886

## 今後わかること

この経緯はまだ進行中です。以下の資料や判断はまだ出ていません。これらによって評価も責任の所在も変わりえます。現時点の記録だけで結論を出さないでください。

各項目の「項目ID」は、出たかどうかを後から照合するための固定の ID です。項目の文面が書き換わっても ID は変わりません。すでに出たものは消さず、「解消した記録」を添えて残します。

### 国立情報学研究所によるLLM構築の進捗・成果の公表

- 項目ID: 3c6888eb-dc14-4323-86a9-4717e7596f07
- 状態: まだ出ていない
- 出すところ: 国立情報学研究所（NII）

これが出ると確定すること:
- NDL提供の官庁出版物約30万点分のテキストデータが実際にどのような大規模言語モデルの学習に使われ、いつ公開・提供されるか
- 提供データがどこまで利用されるか（研究目的限定か、商用モデルへの組み込みも想定するか）

### 著作権保護期間内資料のAI学習データとしての扱いの方針確定

- 項目ID: 6fe95d6a-b283-4282-aff7-2b9f5a5bcb6e
- 状態: まだ出ていない
- 出すところ: 国立国会図書館・資料デジタル化及び利用に係る関係者協議会

これが出ると確定すること:
- 現在提供対象となっている著作権保護期間満了資料（約28万〜35万点）を超えて、保護期間内の蔵書データがAI学習データとして提供される範囲が広がるか
- 出版業界（出版社・著作者団体等）との協議を経て、権利者の懸念にどう応えるかの具体的な条件・除外手続が定まるか

注記: 国立国会図書館は出版社等の関係者を交えた「資料デジタル化及び利用に係る関係者協議会」を継続的に開催しており（令和7年度第2回は2026年2月5日開催予定と検索結果に表示された）、この場での議論の帰趨が今後の提供範囲に影響するとみられる。

### 次世代デジタルライブラリーの実験的サービスからの位置づけ変更

- 項目ID: 8aab52f3-dfbe-4513-8ae0-ca710bffdb56
- 状態: まだ出ていない
- 出すところ: 国立国会図書館

これが出ると確定すること:
- 実験的サービスとして続く次世代デジタルライブラリー（全文検索・テキストモード・構造化テキストデータ提供等）が、正式サービスへ格上げされるか、あるいは実験的機能が国立国会図書館デジタルコレクション本体に統合されるか

## 報道

このケースについて観測できた報道の一覧です。網羅ではなく、「どうやって集めたか」に書いた範囲で見つかったものだけを載せています。探していない媒体・期間・経路があるので、件数を媒体どうしで比べることはできません。ある媒体の記事がここに無いことは、その媒体が報じなかったことを意味しません。

この一覧は網羅ではありません。ある媒体の記事が無いことは、その媒体が報じなかったことを意味しません（探していないだけの可能性があります）。媒体別の件数や順位を比較しないでください。

### どうやって集めたか

- 2026年8月14日 手作業での収集
  - 探索ID: 50ef3ed2-7472-45ce-b9b6-0640761b166d
  - 注記: このケースの records[] の出典として集めてあった報道記事を、そのまま報道一覧に転記したもの。個々の記事をどの検索でいつ見つけたかは記録が残っていない。この分については収集経路をたどれない。報道機関以外（官公庁・企業・団体の公表資料、法律事務所やコンサルの解説、個人の発信）は報道ではないので含めていない。

### 見つかった報道（4件）

- 記事ID: 90334928-0112-4eaf-b0ba-23091ae96a77 ／ 公開日不明 日経クロステック「生成AIの学習に政府保有データを提供へ、国会図書館の蔵書や国の研究データも対象」 https://xtech.nikkei.com/atcl/nxt/news/18/16244/ ／ アーカイブ: https://web.archive.org/web/20260216020504/https://xtech.nikkei.com/atcl/nxt/news/18/16244/ ／ 収集した探索ID: 50ef3ed2-7472-45ce-b9b6-0640761b166d
- 記事ID: 5da9c3a4-6643-4560-a979-8a947033be56 ／ 公開日不明 HON.jp News Blog「国立国会図書館はOpenAIからのデータ提供要請を断っていたなど 日刊出版ニュースまとめ 2025.12.30」 https://hon.jp/news/1.0/0/58004 ／ 収集した探索ID: 50ef3ed2-7472-45ce-b9b6-0640761b166d
- 記事ID: d6bfcb77-0090-4076-a053-4000e327b75b ／ 公開日不明 日本経済新聞「ChatGPT、日本攻略で誤算 扉を閉じた「国会図書館」」 https://www.nikkei.com/prime/digital-governance/article/DGXZQOGN270PK0X20C24A2000000 ／ アーカイブ: https://web.archive.org/web/20250630005354/https://www.nikkei.com/prime/digital-governance/article/DGXZQOGN270PK0X20C24A2000000 ／ 収集した探索ID: 50ef3ed2-7472-45ce-b9b6-0640761b166d
- 記事ID: d631b7bf-25e4-42e9-89cb-f50b0752be82 ／ 公開日不明 ITmedia「官庁出版物30万点、AIモデルに活用へ 国会図書館がNIIに提供」 https://www.itmedia.co.jp/news/articles/2510/02/news102.html ／ アーカイブ: https://web.archive.org/web/20251020224403/https://www.itmedia.co.jp/news/articles/2510/02/news102.html ／ 収集した探索ID: 50ef3ed2-7472-45ce-b9b6-0640761b166d

## このデータの扱いについて

- OpenAIによるNDLへのデータ提供要請とNDLの拒否（r-2024-02-01-openai-request-declined）は、日本経済新聞「ChatGPT、日本攻略で誤算 扉を閉じた『国会図書館』」（2024年3月12日付とみられる）と、これを引用したHON.jp News Blogの記事見出し・要約のみに基づく。要請・拒否の正確な日付、要請の具体的な内容、NDL側の公式コメントの有無は本文未確認。一次資料（NDLの公式発表等）による裏付けが取れていない点に注意。
- 実名は法人・組織名（国立国会図書館、国立情報学研究所、OpenAI、内閣府、AI戦略会議）のみを記載した。私人の実名は含まれない。
- 官庁出版物の全文テキストデータ提供に関する合意日（2025年9月5日）と公表日（2025年10月1日）は検索結果の要約に基づく。両者の関係（合意後に約1か月を経て公表された経緯）の詳細は本文未確認。
