生成AIの学習データや知的財産権への対応について、事業者に自主的な情報開示を促す「プリンシプル・コード」が2026年8月25日にまとまりました。学習に使ったデータの種類やクローラの名前を自社サイトで公開し、権利者や利用者からの照会にも答えることを求める内容です。守らなくても罰則はありませんが、実施しない場合は理由の説明が必要になります。
罰する仕組みではなく、説明させる仕組み
正式名称は「生成AIの適切な利活用等に向けた知的財産の保護及び透明性に関するプリンシプル・コード」です。AI時代の知的財産権検討会での議論を経て策定され、内閣府知的財産戦略推進事務局が窓口になります。
この文書には法的拘束力がありません。代わりに採用されたのが、企業統治の分野で使われてきたコンプライ・オア・エクスプレインという手法です。原則を実施するか、実施しないなら理由を十分に説明する。どちらかを選べばよく、実施しないこと自体は違反になりません。
ただし説明の質は問われます。窓口を作る体制がまだ整っていないと述べるだけでは説明として不十分で、体制がいつ完成するのかまで示すよう求めています。利用規約に原則の適用を制限する条項を置いている場合も、条項の存在を挙げるだけでは足りず、なぜその条項を設けたのかを説明する必要があります。
営業秘密や安全性・セキュリティに関わる機微な情報については、強制的な開示を求めるものではないと明記されました。
自社サイトで公開が求められる項目
原則1は、コーポレートサイトなど誰でも閲覧できるウェブサイトでの情報公開です。中身は透明性の確保と、知的財産権保護のための措置の2本立てになっています。
透明性の側で挙がっているのは、モデルの名称とバージョン、公開日を含む来歴、アーキテクチャや設計仕様、想定用途と禁止用途、トレーニングの方法といった情報です。学習データについては、テキストや画像といったデータの種類、ウェブクロールの実施状況、第三者から取得した非公開データセットや公開データセットの扱い、合成データを使っているかどうかとその目的までが対象になります。クローラの名称・識別子と収集期間、第三者のクローラを使っている場合はその名称も含まれます。
知的財産権保護の側は、実務的な対応の一覧です。ペイウォールやrobots.txtのような機械可読な指示に従うクローラを採用し、ユーザーエージェントごとにその方針を公開して変更時には通知すること。海賊版サイトへのクロールを避けること。学習したログを一定期間保持すること。侵害生成物の生成を防ぐ技術的措置や、電子透かしやC2PAのような出所と来歴を証明する仕組みを可能な範囲で導入すること。権利者向けの窓口を整備し、申出の要件を明確にして対応記録を残すこと。これらの対応状況を開示するよう求めています。
事務局は同じ日に、各項目をどの程度の粒度で書けばよいかを示した具体例集も公開しました。Transformerアーキテクチャ、データ提供業者から取得、◯◯bot:◯年◯月◯日より継続的に収集といった記入例が並んでおり、開示の書式が事業者ごとにばらつくのをある程度は抑えられそうです。
権利者が「自分の作品は学習に使われたか」を聞ける
原則2は、権利者側からの照会に答えることを定めています。想定されているのは、自分の作品をウェブサイトに載せている人が、それと同一または類似の生成物を見つけたケースです。作品の掲載ページのURLを示して、そのドメインがクロール対象に含まれているか、第三者から提供を受けた学習データの取得元に含まれているかを尋ねられます。
誰でも聞けるわけではありません。訴訟や調停、ADR(裁判外紛争解決手続)といった法的手続を現に行っているか、準備している人と、その委任を受けた弁護士などに限られます。照会する側も、その立場にあると信じるに足りる理由を示し、回答の利用目的を明らかにし、目的外には使わないと誓約したうえで、照合したいURLと理由を特定する必要があります。
照会できるのは、示したURLが含まれているかどうかという一点です。作品そのものが学習対象に入っているかを網羅的に問い合わせる制度ではない、と注記されています。生成AI提供者が答えられない場合には、サービスに組み込まれたモデルを開発した事業者の名前を答える形になります。
生成した本人も同じ質問ができる
原則3は、生成AIサービスを使ってコンテンツを生成した利用者からの照会です。画像生成サービスで作った画像が、あるウェブサイトに載っている画像とよく似ていた、といった場面が例に挙がっています。
こちらは法的手続の準備が要件になっていない代わりに、生成物と生成に使ったプロンプトの提示が求められます。さらに、回答を訴訟提起や調停申立て、ADRの申立てには使わないと誓約する必要があります。権利行使のための調査ではなく、自分が作ったものを安心して使えるかを確かめるための窓口、という位置づけです。
原則2と原則3のどちらについても、濫用を防ぐために手数料や一定期間内の回数制限を設けることは想定されています。ただし照会をためらわせるような設定は避けるよう釘が刺されています。
対象になる事業者、外れる事業者
適用されるのは、生成AIシステムを構築して公衆に提供する生成AI開発者と、それを組み込んだサービスを公衆に提供する生成AI提供者です。日本国内に本店や主たる事務所がなくても、日本に向けてサービスを提供していれば対象に含まれます。海外企業も逃れられない設計になっています。
一方で、外れる類型もはっきり書かれています。委託を受けてデータ収集や学習の一部工程だけを担う下請けは原則として含まれません。公衆に提供せず研究開発をしているだけの人も対象外です。1社が保有するデータだけで作り込んだ社内向けの生成AIを、その会社にだけ提供している場合も外れます。統計データや推論結果にとどまる生成物のように、第三者の権利を侵害する生成物が生まれるおそれが著しく低いシステムも同様です。
受け入れた事業者は一覧で公表される
原則を受け入れる事業者は、その旨と各原則の実施事項、実施しない原則があればその理由を自社サイトで公表し、内閣府知的財産戦略推進事務局に所定の様式で届け出ます。内容は原則として毎年見直し、更新したときはその旨も公表します。
事務局は届出があった事業者の一覧と、各社が公表したページへのリンクを公開する予定です。ただし届出内容の審査は行わず、第三者からの照会にも回答しないと明言しています。並べて見せるところまでが役割で、評価は市場に委ねる立て付けです。届出の受付開始時期は別途アナウンスされます。
まとめ
学習データの中身は、これまで各社の裁量に任されてきた領域でした。プリンシプル・コードは、そこに罰則ではなく「開示するか、しない理由を説明するか」という選択を持ち込みます。実効性は、届出一覧に名前を連ねる事業者がどれだけ増えるか、そして各社の説明がどこまで具体的になるかにかかっています。英語版の仮訳も同時に用意されており、海外の事業者にどこまで浸透するかも見どころになりそうです。
