OpenAIは、ChatGPTとCodexが生成するテキストに電子透かしを導入します。
EUでは今後数週間かけて、対象となる出力への適用を進めます。
APIでは10月5日から、世界の利用者が一部モデルで任意に有効化できます。
透かしには、OpenAIが開発した技術「textGrain」を利用します。
記事の概要
今回の対応は、EU AI法が生成AI事業者に生成テキストの機械識別を求めていることを受けたものです。
textGrainは、特殊な文字やメタデータを付加せず、単語選択に統計的な信号を加えます。
専用の検出器で信号を調べることで、文章にOpenAIの透かしが含まれるかを判定します。
APIでは初期設定がオフとなり、10月5日から一部モデルで利用者が任意に有効化できます。
OpenAIの評価では、偽陽性率を1%に設定した場合、心理学などの文章は200トークンで約80%を検出しました。
同じ条件で400トークンでは約95%を検出しましたが、数学などでは検出率が大幅に低下しました。
400トークンの英語文章では、単語の25%を類義語に置き換えると検出率が17%まで低下しました。
記事のポイント
- 導入対象と時期: EUでは対象となるChatGPTとCodexの出力に、今後数週間かけて透かしを適用します。
- 検出精度の限界: 短文や単語の選択肢が少ない文章では、偽陽性や偽陰性が生じ、検出が難しくなります。
- 一般公開は限定: 検出機能は当初、承認された研究者や専門機関に限り、一般向けには公開しない方針です。
このニュースがもたらす影響
- 導入を検討する企業: 生成文の出所確認を透かしだけに委ねるのは難しいため、検出結果を補助材料と位置づけ、編集履歴や人の確認を組み合わせる運用設計が求められそうです。
- 教育・審査機関: 短文や数学の文章、編集後の文では検出精度が下がるため、透かしの有無だけで不正や責任の所在を判断しない判定基準を整える必要があります。
- AIサービス提供者: EU向けには識別可能性への対応が必要になる一方、検出器の一般公開は限定されます。提供地域ごとの設定や利用者への説明を分ける対応が求められそうです。
このニュースの背景
EU AI法が生成テキストを機械で識別可能にするよう求めており、生成AI事業者には法令対応が必要になっています。
OpenAIは、特殊な文字やメタデータを使わず、単語選択に統計的な信号を加える方式を採用しています。
一方で、短文や単語の選択肢が少ない文章、編集された文章では検出率が低下するため、識別結果を単独で扱いにくい事情があります。
関連するニュース
- OpenAI、Meta、xAIが、離席中も仕事を続ける常駐型AIエージェントを提供しています。
- OpenAIが金融データとGPT-6 Astraを組み合わせた金融機関向けChatGPTを提供します。
- OpenAIがMicrosoft Word向けアドインを提供し、文書作成や編集をChatGPTで支援します。
詳しい記事の内容はこちらから(引用元)
OpenAIは、ChatGPTやCodexが生成するテキストに、AIによる生成・処理を識別するための電子透かしを導入する…
https://www.watch.impress.co.jp/docs/news/2145957.html