オープンAI、EUでChatGPT・Codexの生成文に透かし導入へ。検出ツールは当初限定

EU AI法に対応、APIでは世界の利用者が任意に有効化可能

米オープンAI(OpenAI)が、欧州連合(EU)域内の「チャットGPT(ChatGPT)」と「コーデックス(Codex)」に、生成テキストへの電子透かしを導入する方針を10月5日に発表した。

同社によると、今後数週間で対象となるテキスト出力に、目に見えない透かしを付与する予定。両サービスの全プランが対象となる。導入時点では、テキスト透かしを世界共通の標準設定にする予定はないという。

今回の対応は「EU AI法(EU AI Act)」に基づくものだ。同社は、同法が生成AIの提供事業者に対し、生成したテキストを機械で識別できるようにすることを求めていると説明している。

また、同社はテキスト透かしの検出ツールについて、利用申請の受け付けを同日に開始した。アクセスは当初、承認された研究者や専門機関に限定し、個別に審査する。透かしの見逃しや誤検出のリスクを踏まえ、導入時点では一般公開しない方針だ。

導入する透かし技術は「テキストグレイン(textGrain)」。文章を生成する際に単語や単語の一部を選ぶ確率を調整し、文章内に統計的な信号を埋め込む。検出ツールはその信号を調べ、OpenAIの透かしが含まれるかを判定する仕組みだ。隠し文字や不可視の空白を追加するものではないという。

ただし、短文や数学のように表現の選択肢が少ない内容では、透かしを検出しにくいとのこと。文章の書き換えや翻訳によって、検出できなくなる場合もあるという。

同社が公表した400トークンの英文を用いた評価では、単語の10%を同義語に置き換えると、検出率は約92%から66%に低下した。25%を置き換えると、17%まで低下したという。トークンは、AIが文章を処理する際に使う単語や単語の一部などの単位だ。

なお、透かしはOpenAIのモデルが文章の生成や処理に関与した可能性を示すものだ。利用者やプロンプト、会話の内容を特定する情報は含まれない。また、人がどの程度編集したかや、文章の正確性を示すものでもない。透かしが検出されなくても、人が書いた文章であることの証明にはならないとしている。

APIでは、10月5日から世界の利用者が一部モデルでテキスト透かしを任意に有効化できるようになった。初期設定ではオフとなる。APIは、外部のアプリやサービスからOpenAIのモデルを利用するための仕組みだ。なお、APIでテキスト透かしを有効化しても、検出ツールへのアクセスが認められるわけではない。

同社は今後、テキスト透かしの評価と改善を進めるとともに、テキストグレインをオープンソースとして公開する計画も示している。

参考:公式発表・公式ヘルプ
画像:Reuters

関連ニュース

関連するキーワード

#AI

この記事の著者・インタビューイ

大津賀新也

「あたらしい経済」編集部
副編集長
ブロックチェーンに興味を持ったことから、業界未経験ながらも全くの異業種から幻冬舎へ2019年より転職。あたらしい経済編集部では記事執筆の他、音声収録・写真撮影も担当。

「あたらしい経済」編集部
副編集長
ブロックチェーンに興味を持ったことから、業界未経験ながらも全くの異業種から幻冬舎へ2019年より転職。あたらしい経済編集部では記事執筆の他、音声収録・写真撮影も担当。

合わせて読みたい記事

イーサリアムL1からL2へのアトミック取引をメインネットで実行、「史上初」と説明

イーサリアム・エコノミック・ゾーン(Ethereum Economic Zone:EEZ)のコントリビューターであるエドゥアルド・アントゥーニャ(Eduardo Antuña)氏が、イーサリアムのメインネット(L1)からレイヤー2(L2)へのアトミックなクロスチェーントランザクションを実行したと10月6日に自身のXアカウントで発表した