OpenAI は、EU の ChatGPT テキストに目に見えない透かしを追加します。特殊文字は必要ありません。書き換えると無効になる場合があります。

📅 2026-10-06

要約:

OpenAI は、AI によって生成されたコンテンツの可読性に関する EU 人工知能法の要件を満たすために、欧州連合の ChatGPT および Codex によって生成されたテキストに目に見えない透かしを徐々に追加しています。 OpenAIによると、textGrainと呼ばれるこのテキスト透かし技術は、記事に隠し文字、目に見えないスペース、または特別な句読点を追加するものではないという。代わりに、モデルがテキストを生成するときに単語の選択方法を調整し、人間の目では直接検出できないが、機械では認識できるテキスト全体の統計的特徴を形成します。

1780081657_chatgpt_logo.webp

OpenAI が発表した情報によると、欧州連合の人工知能法の関連する透明性要件が 2026 年 8 月 2 日に発効します。生成 AI サービス プロバイダーは、機械認識可能なマークが付いた AI 生成コンテンツを用意する必要があります。したがって、OpenAI は、今後数週間で EU 内の対象となる ChatGPT および Codex ユーザーにテキスト ウォーターマークを段階的に展開する予定であり、この展開は有料ユーザーだけでなく、すべての ChatGPT パッケージを対象とします。

この種の透かしは、伝統的な意味での「隠しテキスト」とは異なります。ユーザーが ChatGPT によって生成されたコンテンツをコピーする場合、隠し文字は同時にコピーされず、テキスト内に特殊な記号も検出されません。 textGrain が実際に変更するのは、複数の可能な単語に直面したときのモデルのランダム選択確率です。単一の単語の変化はまったく検出できない場合がありますが、多数の単語が組み合わされると、検出システムが認識できる統計的パターンが形成される場合があります。

OpenAI は、この設計の利点は、通常のテキスト出力を大幅に変更しないことであると述べています。同社のテストでは、ウォーターマークを追加した場合と追加しない場合のモデルのパフォーマンスの差は、通常のテスト変動の範囲内であり、テキスト生成速度への影響も非常に小さいことがわかりました。 OpenAI が以前実施した ChatGPT の内部テストでは、ウォーターマーク機能がユーザーの否定的なレビューの増加につながることは見つかりませんでした。

ただし、OpenAI は、テキスト透かしが AI コンテンツを識別する 100% 信頼できる方法ではないことも認めました。透かし検出には 2 つのエラーが考えられます。 1 つは、透かしのないテキストが透かしがあると誤って判断されること、もう 1 つは、実際には透かしが入っているにもかかわらず、検出システムがそれを認識しないことです。

テキストの長さも、検出結果に影響を与える重要な要素です。テキストが短いと、モデルが単語の選択を調整する余地が少なくなり、安定した統計信号を形成することがより困難になります。 OpenAI によって公開されたルールは、EU AI の透明性仕様に従って、200 未満のトークン、約 150 の英単語、およびコード スニペットの出力にはテキスト透かしを追加する必要がないことも示しています。

言語が異なると検出結果にも違いがあります。 OpenAI は、欧州連合の 24 の公用語すべてをテストしました。偽陽性率 1% を維持しながら、スペイン語の検出率は最大 69% に達しましたが、ルーマニア語の検出率はわずか 42.2% でした。検出効果が弱い言語の場合、OpenAI はウォーターマークの強度を上げて検出機能を強化できます。

これは、textGrain がウォーターマークを見たときに ChatGPT によって生成されたことを 100% 証明できる技術として理解できないことを意味します。 OpenAI は、元のテキストが変更されていない場合でも、特にテキストが短い場合や選択可能な単語の範囲が狭い場合には、検出システムが透かしを検出できるという保証がないことを明確にしています。

同時に、テキスト透かしと現在市販されている AI テキスト検出器の間には明らかな違いがあります。 Pangram などのサードパーティ AI 検出ツールは、主に分類器を使用して、単語の選択、文の構造、その他の言語の特徴を分析することで、テキストの一部が AI によって生成された可能性が高いかどうかを判断します。このメソッドは生成されたテキストを分析しますが、textGrain はテキスト生成プロセス中に機械可読な統計信号を直接残します。

OpenAI は、このアプローチが「埋め込まれた」識別可能な信号に関する EU AI 法の要件により合致していると考えています。

OpenAI は、Google DeepMind の SynthID やその他の既存のテキスト透かしソリューションを直接採用せず、独自に textGrain を開発しました。同社は、自社開発の技術により、透かしの検出可能性とモデル出力の多様性の間のバランスをより柔軟に調整できると述べた。社内テストでは、textGrain は、テキスト用の SynthID を含め、同社がテストした他のソリューションと同等以上の速度で透かし入りテキストを認識しました。

OpenAI は、textGrain テクノロジーのオープンソース化も計画しており、他の研究機関や企業がこのテクノロジーを使用して AI テキスト ソース認識をさらに研究し、改善できることを期待しています。ただし、OpenAI はテキスト透かし検出器をすぐに一般公開するわけではなく、まず承認された研究者や専門機関にアプリケーション チャネルを提供します。

これらの認定された研究者や機関は、OpenAI の検出ツールを使用して、テキストの一部に OpenAI によって生成されたウォーターマークが含まれているかどうかを判断できますが、検出結果によって、生成されたコンテンツに対応するユーザー ID、プロンプト ワード、またはチャット記録が明らかになることはありません。 OpenAI は、現在のテクノロジーには依然として偽陽性と偽陰性のリスクがあるため、検出ツールをすべての人に直接公開すると、透かし検出結果の拡大解釈につながる可能性があると考えています。

注目に値するのは、OpenAI は今回、デフォルトでテキスト透かしをグローバルに有効にする予定はないということです。同社は、ChatGPT と Codex のテキスト ウォーターマークは、現段階では EU 地域のみに段階的に展開されると述べています。この地域展開により、OpenAI は実際の使用環境でのパフォーマンスを観察し、実際のフィードバックに基づいてテクノロジーを調整できるようになります。

API 開発者の場合は状況が異なります。 OpenAI は、グローバル API 顧客が一部のモデルに対してテキスト透かし機能を積極的に有効にすることを許可し始めていますが、デフォルトではまだ無効になっています。これは、企業が独自の透明性要件に基づいて、API を通じて生成されたテキストに透かしを入れるかどうかを決定できることを意味します。

OpenAI はクラウド サービス パートナーとも調整しており、今後数週間以内に、これらのクラウド プラットフォームを介して OpenAI モデルを呼び出すことによって生成された対象コンテンツも、対応するソース信号を受信できるようになることを期待しています。

ただし、テキスト透かしは他の AI コンテンツ識別方法に代わるものではありません。 OpenAIは、機械可読透かしやC2PAなどのソース情報は、法律やプラットフォームで求められる目に見えるAIラベルやプロンプトバナーなどの公的声明に代わることはできないと強調している。これらは、さまざまなレベルでコンテンツ ソースの問題を解決します。

一般ユーザーにとって、この変更で最も注目すべき点は、EU 圏内にいて、ChatGPT を使用して長いテキストを生成している場合、ウォーターマーク システムがアカウントを正式にカバーした時点から、生成されたコンテンツにはすでに肉眼では見えないソース信号が含まれている可能性があることです。通常、元のテキストを直接コピーしてもこの信号は破壊されませんが、テキストが大幅に書き換えられたり、言い換えられたり、翻訳されたりすると、透かしの検出可能性が大幅に低下する可能性があります。

OpenAI もこの制限を明示的に認めています。 textGrain の信号は、テキスト ファイルに独立して添付された非表示の文字としてではなく、モデルの単語選択の中に存在します。したがって、テキストを十分に書き換えると、元の統計パターンが破壊される可能性があります。このため、OpenAIは、現時点ではテキスト透かしの方がソース判定信号として適しており、絶対的に信頼できる「AI識別証明書」とはみなせないと強調している。

一般的に言えば、OpenAI は今回、主に AI 法によってもたらされた新しい規制要件に適応するために EU で textGrain を立ち上げました。また、AI が生成したテキストのソース識別が、従来の「宣言型タグ」から機械認識可能な信号に進化していることも表しています。ユーザーに表示されるテキストが変更されることはなく、テキストをコピーするときに謎の文字が表示されることもありませんが、検出権限を持つシステムは、コンテンツの一部が OpenAI モデルからのものであるかどうかを判断できるようになります。

しかし、テキストウォーターマークには、言語の違い、テキストの長さの制限、書き換え後の信号の弱まりなどの問題が依然として残っているため、現時点では、記事が「AIによって書かれた」かどうかを判断するために単独で使用されるよりも、AIコンテンツトレーサビリティシステムの補助証拠として適しています。

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし